TY - RPRT TI - World4RL: Diffusion World Models for Policy Refinement with Reinforcement Learning for Robotic Manipulation AU - Zhennan Jiang AU - Kai Liu AU - Yuxin Qin AU - Shuai Tian AU - Yupeng Zheng AU - Mingcai Zhou AU - Chao Yu AU - Haoran Li AU - Dongbin Zhao PY - 2026 UR - https://arxiv.org/abs/2509.19080 ID - 2509.19080 ER -