TY - RPRT TI - ViTCoT: Video-Text Interleaved Chain-of-Thought for Boosting Video Understanding in Large Language Models AU - Yongheng Zhang AU - Xu Liu AU - Ruihan Tao AU - Qiguang Chen AU - Hao Fei AU - Wanxiang Che AU - Libo Qin PY - 2025 UR - https://arxiv.org/abs/2507.09876 ID - 2507.09876 ER -