@misc{indiciae65ff376d4a7f, title = {Insight-V: Exploring Long-Chain Visual Reasoning with Multimodal Large Language Models}, author = {Yuhao Dong and Zuyan Liu and Hai-Long Sun and Jingkang Yang and Winston Hu and Yongming Rao and Ziwei Liu}, year = {2025}, url = {https://arxiv.org/abs/2411.14432}, note = {Source identifier: 2411.14432} }