@misc{indiciaeae02ecab9888, title = {Unified Diffusion VLA: Vision-Language-Action Model via Joint Discrete Denoising Diffusion Process}, author = {Jiayi Chen and Wenxuan Song and Pengxiang Ding and Ziyang Zhou and Han Zhao and Feilong Tang and Donglin Wang and Haoang Li}, year = {2026}, url = {https://arxiv.org/abs/2511.01718}, note = {Source identifier: 2511.01718} }