@misc{indiciae6aa983a437b4, title = {SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model}, author = {Delin Qu and Haoming Song and Qizhi Chen and Yuanqi Yao and Xinyi Ye and Yan Ding and Zhigang Wang and JiaYuan Gu and Bin Zhao and Dong Wang and Xuelong Li}, year = {2025}, url = {https://arxiv.org/abs/2501.15830}, note = {Source identifier: 2501.15830} }