@misc{indiciae6b4f54029fd1, title = {QAPruner: Quantization-Aware Vision Token Pruning for Multimodal Large Language Models}, author = {Xinhao Wang and Zhonyu Xia and Zhiwei Lin and Zhe Li and Yongtao Wang}, year = {2026}, url = {https://arxiv.org/abs/2604.02816}, note = {Source identifier: 2604.02816} }