TY - RPRT TI - Improving the Reasoning of Multi-Image Grounding in MLLMs via Reinforcement Learning AU - Bob Zhang AU - Haoran Li AU - Tao Zhang AU - Jianan Li AU - Cilin Yan AU - Xikai Liu AU - Jiayin Cai AU - Yanbin Hao PY - 2026 UR - https://arxiv.org/abs/2507.00748 ID - 2507.00748 ER -