@misc{indiciae55d9e0817e95, title = {Enhancing Visual Question Answering through Ranking-Based Hybrid Training and Multimodal Fusion}, author = {Peiyuan Chen and Zecheng Zhang and Yiping Dong and Li Zhou and Han Wang}, year = {2024}, url = {https://arxiv.org/abs/2408.07303}, note = {Source identifier: 2408.07303} }