@misc{indiciae2941e95e564e, title = {Do Vision and Language Encoders Represent the World Similarly?}, author = {Mayug Maniparambil and Raiymbek Akshulakov and Yasser Abdelaziz Dahou Djilali and Sanath Narayan and Mohamed El Amine Seddik and Karttikeya Mangalam and Noel E. O'Connor}, year = {2024}, url = {https://arxiv.org/abs/2401.05224}, note = {Source identifier: 2401.05224} }