@misc{indiciae25c4f6e8b156, title = {OmniVLA-RL: A Vision-Language-Action Model with Spatial Understanding and Online RL}, author = {Haoxiang Jie and Yaoyuan Yan and Xiangyu Wei and Kailin Wang and Hongjie Yan and Zhiyou Heng and Daocheng Chen}, year = {2026}, url = {https://arxiv.org/abs/2604.17706}, note = {Source identifier: 2604.17706} }