TY - RPRT TI - Gradient-Adaptive Policy Optimization: Towards Multi-Objective Alignment of Large Language Models AU - Chengao Li AU - Hanyu Zhang AU - Yunkun Xu AU - Hongyan Xue AU - Xiang Ao AU - Qing He PY - 2025 UR - https://arxiv.org/abs/2507.01915 ID - 2507.01915 ER -