@misc{indiciae5f7c08509c20, title = {AnchorVLA4D: an Anchor-Based Spatial-Temporal Vision-Language-Action Model for Robotic Manipulation}, author = {Juan Zhu and Zhanying Shao and Xiaoqi Li and Ethan Morgan and Jiadong Xu and Hongwei Fan and Hao Dong}, year = {2026}, url = {https://arxiv.org/abs/2603.12730}, note = {Source identifier: 2603.12730} }