TY - RPRT TI - VoCoT: Unleashing Visually Grounded Multi-Step Reasoning in Large Multi-Modal Models AU - Zejun Li AU - Ruipu Luo AU - Jiwen Zhang AU - Minghui Qiu AU - Xuanjing Huang AU - Zhongyu Wei PY - 2025 UR - https://arxiv.org/abs/2405.16919 ID - 2405.16919 ER -