@misc{indiciaee73e5a9c3412, title = {Beyond Cross-Modal Alignment: Measuring and Leveraging Modality Gap in Vision-Language Models}, author = {Hanqi Yan and Xiangxiang Cui and Lu Yin and Jindong Gu and Paul Pu Liang and Yulan He and Yifei Wang}, year = {2026}, url = {https://arxiv.org/abs/2502.14888}, note = {Source identifier: 2502.14888} }