TY - RPRT TI - AAPA: Adversarially Anchored Preference Alignment for Post-Training of Large Language Models AU - Faqiang Qian AU - Kang An AU - Weikun Zhang AU - Ziliang Wang AU - Xuhui Zheng AU - Liangjian Wen AU - Yong Dai AU - Mengya Gao AU - Yichao Wu PY - 2026 UR - https://arxiv.org/abs/2509.25148 ID - 2509.25148 ER -