TY - RPRT TI - Any-step Dynamics Model Improves Future Predictions for Online and Offline Reinforcement Learning AU - Haoxin Lin AU - Yu-Yan Xu AU - Yihao Sun AU - Zhilong Zhang AU - Yi-Chen Li AU - Chengxing Jia AU - Junyin Ye AU - Jiaji Zhang AU - Yang Yu PY - 2024 UR - https://arxiv.org/abs/2405.17031 ID - 2405.17031 ER -