@misc{indiciaeb300b3e4908a, title = {OpenViVQA: Task, Dataset, and Multimodal Fusion Models for Visual Question Answering in Vietnamese}, author = {Nghia Hieu Nguyen and Duong T. D. Vo and Kiet Van Nguyen and Ngan Luu-Thuy Nguyen}, year = {2023}, doi = {10.1016/j.inffus.2023.101868}, url = {https://arxiv.org/abs/2305.04183}, note = {Source identifier: 2305.04183} }