@misc{indiciaecd29f5517670, title = {HiST-VLA: A Hierarchical Spatio-Temporal Vision-Language-Action Model for End-to-End Autonomous Driving}, author = {Yiru Wang and Zichong Gu and Yu Gao and Anqing Jiang and Zhigang Sun and Shuo Wang and Yuwen Heng and Hao Sun}, year = {2026}, url = {https://arxiv.org/abs/2602.13329}, note = {Source identifier: 2602.13329} }