@misc{indiciaeea2f54b9cc06, title = {Understand, Think, and Answer: Advancing Visual Reasoning with Large Multimodal Models}, author = {Yufei Zhan and Hongyin Zhao and Yousong Zhu and Shurong Zheng and Fan Yang and Ming Tang and Jinqiao Wang}, year = {2025}, url = {https://arxiv.org/abs/2505.20753}, note = {Source identifier: 2505.20753} }