@misc{indiciaec4cdfd59a4a1, title = {M5 -- A Diverse Benchmark to Assess the Performance of Large Multimodal Models Across Multilingual and Multicultural Vision-Language Tasks}, author = {Florian Schneider and Sunayana Sitaram}, year = {2024}, url = {https://arxiv.org/abs/2407.03791}, note = {Source identifier: 2407.03791} }