@misc{indiciae3d67625fb59b, title = {Thinker: A vision-language foundation model for embodied intelligence}, author = {Baiyu Pan and Daqin Luo and Junpeng Yang and Jiyuan Wang and Yixuan Zhang and Hailin Shi and Jichao Jiao}, year = {2026}, url = {https://arxiv.org/abs/2601.21199}, note = {Source identifier: 2601.21199} }