TY - RPRT TI - Rewards-in-Context: Multi-objective Alignment of Foundation Models with Dynamic Preference Adjustment AU - Rui Yang AU - Xiaoman Pan AU - Feng Luo AU - Shuang Qiu AU - Han Zhong AU - Dong Yu AU - Jianshu Chen PY - 2024 UR - https://arxiv.org/abs/2402.10207 ID - 2402.10207 ER -