@misc{indiciae55a7f28be90c, title = {VLA-Thinker: Boosting Vision-Language-Action Models through Thinking-with-Image Reasoning}, author = {Chaoyang Wang and Wenrui Bao and Sicheng Gao and Bingxin Xu and Yu Tian and Yogesh S. Rawat and Yunhao Ge and Yuzhang Shang}, year = {2026}, url = {https://arxiv.org/abs/2603.14523}, note = {Source identifier: 2603.14523} }