TY - RPRT TI - EmbodiedMidtrain: Bridging the Gap between Vision-Language Models and Vision-Language-Action Models via Mid-training AU - Yiyang Du AU - Zhanqiu Guo AU - Xin Ye AU - Liu Ren AU - Chenyan Xiong PY - 2026 UR - https://arxiv.org/abs/2604.20012 ID - 2604.20012 ER -