TY - RPRT TI - Adversarial Preference Learning for Robust LLM Alignment AU - Yuanfu Wang AU - Pengyu Wang AU - Chenyang Xi AU - Bo Tang AU - Junyi Zhu AU - Wenqiang Wei AU - Chen Chen AU - Chao Yang AU - Jingfeng Zhang AU - Chaochao Lu AU - Yijun Niu AU - Keming Mao AU - Zhiyu Li AU - Feiyu Xiong AU - Jie Hu AU - Mingchuan Yang PY - 2025 UR - https://arxiv.org/abs/2505.24369 ID - 2505.24369 ER -