TY - RPRT TI - MODULI: Unlocking Preference Generalization via Diffusion Models for Offline Multi-Objective Reinforcement Learning AU - Yifu Yuan AU - Zhenrui Zheng AU - Zibin Dong AU - Jianye Hao PY - 2025 UR - https://arxiv.org/abs/2408.15501 ID - 2408.15501 ER -