TY - RPRT TI - KG-ViP: Bridging Knowledge Grounding and Visual Perception in Multi-modal LLMs for Visual Question Answering AU - Zhiyang Li AU - Ao Ke AU - Yukun Cao AU - Xike Xie PY - 2026 UR - https://arxiv.org/abs/2601.11632 ID - 2601.11632 ER -