@misc{indiciaeebf78b8d480c, title = {Hybrid-Level Instruction Injection for Video Token Compression in Multi-modal Large Language Models}, author = {Zhihang Liu and Chen-Wei Xie and Pandeng Li and Liming Zhao and Longxiang Tang and Yun Zheng and Chuanbin Liu and Hongtao Xie}, year = {2025}, url = {https://arxiv.org/abs/2503.16036}, note = {Source identifier: 2503.16036} }