@misc{indiciae0bf1ffefa35b, title = {WikiSeeker: Rethinking the Role of Vision-Language Models in Knowledge-Based Visual Question Answering}, author = {Yingjian Zhu and Xinming Wang and Kun Ding and Ying Wang and Bin Fan and Shiming Xiang}, year = {2026}, url = {https://arxiv.org/abs/2604.05818}, note = {Source identifier: 2604.05818} }