@misc{indiciae1e8521305d84, title = {Can Visual Input Be Compressed? A Visual Token Compression Benchmark for Large Multimodal Models}, author = {Tianfan Peng and Yuntao Du and Pengzhou Ji and Shijie Dong and Kailin Jiang and Mingchuan Ma and Yijun Tian and Jinhe Bi and Qian Li and Wei Du and Feng Xiao and Lizhen Cui}, year = {2025}, url = {https://arxiv.org/abs/2511.02650}, note = {Source identifier: 2511.02650} }