@misc{indiciae34ddd94200e9, title = {VLM-R\$\textasciicircum{}3\$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought}, author = {Chaoya Jiang and Yongrui Heng and Wei Ye and Han Yang and Haiyang Xu and Ming Yan and Ji Zhang and Fei Huang and Shikun Zhang}, year = {2025}, url = {https://arxiv.org/abs/2505.16192}, note = {Source identifier: 2505.16192} }