@misc{indiciae924a9874a3cf, title = {LookWise: Knowing When and Where to Look for Fine-Grained Visual Reasoning in Multimodal Large Language Models}, author = {Yuxiang Shen and Hailong Huang and Zhenkun Gao and Xueheng Li and Man Zhou and Chengjun Xie and Haoxuan Che and Xuanhua He and Jie Zhang}, year = {2026}, url = {https://arxiv.org/abs/2603.00171}, note = {Source identifier: 2603.00171} }