@misc{indiciae438cb45cf536, title = {MAGIC-VQA: Multimodal And Grounded Inference with Commonsense Knowledge for Visual Question Answering}, author = {Shuo Yang and Siwen Luo and Soyeon Caren Han and Eduard Hovy}, year = {2025}, url = {https://arxiv.org/abs/2503.18491}, note = {Source identifier: 2503.18491} }