TY - RPRT TI - MiVLA: Towards Generalizable Vision-Language-Action Model with Human-Robot Mutual Imitation Pre-training AU - Zhenhan Yin AU - Xuanhan Wang AU - Jiahao Jiang AU - Kaiyuan Deng AU - Pengqi Chen AU - Shuangle Li AU - Chong Liu AU - Xing Xu AU - Jingkuan Song AU - Lianli Gao AU - Heng Tao Shen PY - 2025 UR - https://arxiv.org/abs/2512.15411 ID - 2512.15411 ER -