@misc{indiciaef5a84e63c9e5, title = {VLCache: Computing 2\% Vision Tokens and Reusing 98\% for Vision-Language Inference}, author = {Shengling Qin and Hao Yu and Chenxin Wu and Zheng Li and Yizhong Cao and Zhengyang Zhuge and Yuxin Zhou and Wentao Yao and Yi Zhang and Zhengheng Wang and Shuai Bai and Jianwei Zhang and Junyang Lin}, year = {2025}, url = {https://arxiv.org/abs/2512.12977}, note = {Source identifier: 2512.12977} }