@misc{indiciaebd717663eabf, title = {MiVLA: Towards Generalizable Vision-Language-Action Model with Human-Robot Mutual Imitation Pre-training}, author = {Zhenhan Yin and Xuanhan Wang and Jiahao Jiang and Kaiyuan Deng and Pengqi Chen and Shuangle Li and Chong Liu and Xing Xu and Jingkuan Song and Lianli Gao and Heng Tao Shen}, year = {2025}, url = {https://arxiv.org/abs/2512.15411}, note = {Source identifier: 2512.15411} }