TY - RPRT TI - Constructing Multilingual Visual-Text Datasets Revealing Visual Multilingual Ability of Vision Language Models AU - Jesse Atuhurra AU - Iqra Ali AU - Tatsuya Hiraoka AU - Hidetaka Kamigaito AU - Tomoya Iwakura AU - Taro Watanabe PY - 2024 UR - https://arxiv.org/abs/2406.15359 ID - 2406.15359 ER -