TY - RPRT TI - From Image to Video, what do we need in multimodal LLMs? AU - Suyuan Huang AU - Haoxin Zhang AU - Linqing Zhong AU - Honggu Chen AU - Yan Gao AU - Yao Hu AU - Zengchang Qin PY - 2025 UR - https://arxiv.org/abs/2404.11865 ID - 2404.11865 ER -