TY - RPRT TI - How Many Visual Tokens Do Multimodal Language Models Need? Scaling Visual Token Pruning with F^3A AU - YiJie Huang AU - Yiqun Zhang AU - Zhuoyue Jia AU - Xiaocui Yang AU - Junzhao Huang AU - Zihan Wang AU - Shi Feng AU - Daling Wang AU - Yifei Zhang AU - Yongkang Liu PY - 2026 UR - https://arxiv.org/abs/2605.16359 ID - 2605.16359 ER -