@misc{indiciae70706b6422a4, title = {Vision-DeepResearch: Incentivizing DeepResearch Capability in Multimodal Large Language Models}, author = {Wenxuan Huang and Yu Zeng and Qiuchen Wang and Zhen Fang and Shaosheng Cao and Zheng Chu and Qingyu Yin and Shuang Chen and Zhenfei Yin and Lin Chen and Zehui Chen and Xu Tang and Yao Hu and Shaohui Lin and Philip Torr and Feng Zhao and Wanli Ouyang}, year = {2026}, url = {https://arxiv.org/abs/2601.22060}, note = {Source identifier: 2601.22060} }