@misc{indiciaea6bc9fe4af08, title = {Rethinking the Practicality of Vision-language-action Model: A Comprehensive Benchmark and An Improved Baseline}, author = {Wenxuan Song and Jiayi Chen and Xiaoquan Sun and Huashuo Lei and Yikai Qin and Wei Zhao and Pengxiang Ding and Han Zhao and Tongxin Wang and Pengxu Hou and Zhide Zhong and Haodong Yan and Donglin Wang and Jun Ma and Haoang Li}, year = {2026}, url = {https://arxiv.org/abs/2602.22663}, note = {Source identifier: 2602.22663} }