TY - RPRT TI - Policy-regularized Offline Multi-objective Reinforcement Learning AU - Qian Lin AU - Chao Yu AU - Zongkai Liu AU - Zifan Wu PY - 2024 UR - https://arxiv.org/abs/2401.02244 ID - 2401.02244 ER -