@misc{indiciae9177afc242ef, title = {Enhancing Vision-Language Model with Unmasked Token Alignment}, author = {Jihao Liu and Jinliang Zheng and Boxiao Liu and Yu Liu and Hongsheng Li}, year = {2024}, url = {https://arxiv.org/abs/2405.19009}, note = {Source identifier: 2405.19009} }