TY - RPRT TI - ST4VLA: Spatially Guided Training for Vision-Language-Action Models AU - Jinhui Ye AU - Fangjing Wang AU - Ning Gao AU - Junqiu Yu AU - Yangkun Zhu AU - Bin Wang AU - Jinyu Zhang AU - Weiyang Jin AU - Yanwei Fu AU - Feng Zheng AU - Yilun Chen AU - Jiangmiao Pang PY - 2026 UR - https://arxiv.org/abs/2602.10109 ID - 2602.10109 ER -