TY - RPRT TI - dVLA-RL: Reinforcement Learning over Denoising Trajectories for Discrete Diffusion Vision-Language-Action Models AU - Yuhao Wu AU - Yitian Liu AU - Weijie Shen AU - Mishuo Han AU - Wenjie Xu AU - Haotian Liang AU - Zhongshan Liu AU - Yinan Mao AU - Lei Xu AU - Xinping Guan AU - Ru Ying AU - Ran Zheng AU - Wei Sui AU - Xiaokang Yang AU - Wenbo Ding AU - Yao Mu PY - 2026 UR - https://arxiv.org/abs/2606.23623 ID - 2606.23623 ER -