TY - RPRT TI - Small Vision-Language Models are Smart Compressors for Long Video Understanding AU - Junjie Fei AU - Jun Chen AU - Zechun Liu AU - Yunyang Xiong AU - Chong Zhou AU - Wei Wen AU - Junlin Han AU - Mingchen Zhuge AU - Saksham Suri AU - Qi Qian AU - Shuming Liu AU - Lemeng Wu AU - Raghuraman Krishnamoorthi AU - Vikas Chandra AU - Mohamed Elhoseiny AU - Chenchen Zhu PY - 2026 UR - https://arxiv.org/abs/2604.08120 ID - 2604.08120 ER -