TY - RPRT TI - Temporal Gains, Spatial Costs: Revisiting Video Fine-Tuning in Multimodal Large Language Models AU - Linghao Zhang AU - Jungang Li AU - Yonghua Hei AU - Sicheng Tao AU - Song Dai AU - Yibo Yan AU - Zihao Dongfang AU - Weiting Liu AU - Chenxi Qin AU - Hanqian Li AU - Xin Zou AU - Jiahao Zhang AU - Shuhang Xun AU - Haiyun Jiang AU - Xuming Hu PY - 2026 UR - https://arxiv.org/abs/2603.17541 ID - 2603.17541 ER -