@misc{indiciae034e44c2d4ee, title = {ROCKET: Residual-Oriented Multi-Layer Alignment for Spatially-Aware Vision-Language-Action Models}, author = {Guoheng Sun and Tingting Du and Kaixi Feng and Chenxiang Luo and Xingguo Ding and Zheyu Shen and Ziyao Wang and Yexiao He and Ang Li}, year = {2026}, url = {https://arxiv.org/abs/2602.17951}, note = {Source identifier: 2602.17951} }