@misc{indiciae05ab02ff961a, title = {Teaching Vision-Language-Action Models What to See and Where to Look}, author = {Yuguang Yang and Canyu Chen and Zhewen Tan and Yizhi Wang and Zichao Feng and Chunyang Liu and Kehua Sheng and Juan Zhang and Linlin Yang and Baochang Zhang and Yan Wang and Bo Zhang and Xianbin Cao}, year = {2026}, url = {https://arxiv.org/abs/2607.01658}, note = {Source identifier: 2607.01658} }