@misc{indiciae6c3527315fe5, title = {HALO: A Unified Vision-Language-Action Model for Embodied Multimodal Chain-of-Thought Reasoning}, author = {Quanxin Shou and Fangqi Zhu and Shawn Chen and Puxin Yan and Zhengyang Yan and Yikun Miao and Xiaoyi Pang and Zicong Hong and Ruikai Shi and Hao Huang and Jie Zhang and Song Guo}, year = {2026}, url = {https://arxiv.org/abs/2602.21157}, note = {Source identifier: 2602.21157} }