@misc{indiciaefebdcd41e781, title = {Scaling World-Model Reinforcement Learning Through Diffusion Policy Optimization}, author = {Xiaoyuan Cheng and Wenxuan Yuan and Zhancun Mu and Yuanzhao Zhang and Yiming Yang and Hai Wang and Zhuo Sun and Che Liu}, year = {2026}, url = {https://arxiv.org/abs/2605.26282}, note = {Source identifier: 2605.26282} }