TY - RPRT TI - Multi-Objective Reinforcement Learning for Large Language Model Optimization: Visionary Perspective AU - Lingxiao Kong AU - Cong Yang AU - Oya Deniz Beyan AU - Zeyd Boukhers PY - 2025 UR - https://arxiv.org/abs/2509.21613 ID - 2509.21613 ER -