@misc{indiciae8aedb9582215, title = {LoHoVLA: A Unified Vision-Language-Action Model for Long-Horizon Embodied Tasks}, author = {Yi Yang and Jiaxuan Sun and Siqi Kou and Yihan Wang and Zhijie Deng}, year = {2025}, url = {https://arxiv.org/abs/2506.00411}, note = {Source identifier: 2506.00411} }