@misc{indiciae11353e4cf870, title = {MAIN-VLA: Modeling Abstraction of Intention and eNvironment for Vision-Language-Action Models}, author = {Zheyuan Zhou and Liang Du and Zixun Sun and Xiaoyu Zhou and Ruimin Ye and Qihao Chen and Yinda Chen and Lemiao Qiu}, year = {2026}, url = {https://arxiv.org/abs/2602.02212}, note = {Source identifier: 2602.02212} }