TY - RPRT TI - MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models AU - Yin Zhang AU - Jiaxuan Zhao AU - Zonghan Wu AU - Zengxiang Li AU - Junfeng Fang AU - Kun Wang AU - Qingsong Wen AU - Yilei Shao PY - 2026 UR - https://arxiv.org/abs/2605.01520 ID - 2605.01520 ER -