@misc{indiciae4217b98935b2, title = {COSMOS: Cross-Modality Self-Distillation for Vision Language Pre-training}, author = {Sanghwan Kim and Rui Xiao and Mariana-Iuliana Georgescu and Stephan Alaniz and Zeynep Akata}, year = {2025}, url = {https://arxiv.org/abs/2412.01814}, note = {Source identifier: 2412.01814} }