TY - RPRT TI - Mitigating Distribution Shift in Model-based Offline RL via Shifts-aware Reward Learning AU - Wang Luo AU - Haoran Li AU - Zicheng Zhang AU - Congying Han AU - Chi Zhou AU - Jiayu Lv AU - Tiande Guo PY - 2025 UR - https://arxiv.org/abs/2408.12830 ID - 2408.12830 ER -