@misc{indiciaec1212ee885ad, title = {ShortV: Efficient Multimodal Large Language Models by Freezing Visual Tokens in Ineffective Layers}, author = {Qianhao Yuan and Qingyu Zhang and Yanjiang Liu and Jiawei Chen and Yaojie Lu and Hongyu Lin and Jia Zheng and Xianpei Han and Le Sun}, year = {2025}, url = {https://arxiv.org/abs/2504.00502}, note = {Source identifier: 2504.00502} }