TY - RPRT TI - Beyond Human Demonstrations: Diffusion-Based Reinforcement Learning to Generate Data for VLA Training AU - Rushuai Yang AU - Hangxing Wei AU - Ran Zhang AU - Zhiyuan Feng AU - Xiaoyu Chen AU - Tong Li AU - Chuheng Zhang AU - Li Zhao AU - Jiang Bian AU - Xiu Su AU - Yi Chen PY - 2025 UR - https://arxiv.org/abs/2509.19752 ID - 2509.19752 ER -