@misc{indiciae9442d4c895a3, title = {Rethinking Visual Token Compression for Video Large Language Models: A Simple Yet Strong Baseline}, author = {Xiao Zhang and Wang Zeng and Sheng Jin and Wentao Liu and Chen Qian and Shichao Kan}, year = {2026}, url = {https://arxiv.org/abs/2609.35394}, note = {Source identifier: 2609.35394} }