TY - RPRT TI - What Do Visual Tokens Really Encode? Uncovering Sparsity and Redundancy in Multimodal Large Language Models AU - Yingqi Fan AU - Junlong Tong AU - Anhao Zhao AU - Xiaoyu Shen PY - 2026 UR - https://arxiv.org/abs/2603.00510 ID - 2603.00510 ER -