@misc{indiciae15c782496cbb, title = {Vidar: Embodied Video Diffusion Model for Generalist Manipulation}, author = {Yao Feng and Hengkai Tan and Xinyi Mao and Chendong Xiang and Guodong Liu and Shuhe Huang and Hang Su and Jun Zhu}, year = {2025}, url = {https://arxiv.org/abs/2507.12898}, note = {Source identifier: 2507.12898} }