@misc{indiciaedc6b3781241c, title = {CoreMatching: A Co-adaptive Sparse Inference Framework with Token and Neuron Pruning for Comprehensive Acceleration of Vision-Language Models}, author = {Qinsi Wang and Hancheng Ye and Ming-Yu Chung and Yudong Liu and Yueqian Lin and Martin Kuo and Mingyuan Ma and Jianyi Zhang and Yiran Chen}, year = {2025}, url = {https://arxiv.org/abs/2505.19235}, note = {Source identifier: 2505.19235} }