TY - RPRT TI - IVR-R1: Refining Trajectories through Iterative Visual-Grounded Reasoning in Reinforcement Learning AU - Chenghao Li AU - Fusheng Hao AU - Xikai Zhang AU - Likang Xiao AU - Yanwei Ren AU - Fuxiang Wu AU - Quan Chen AU - Liu Liu PY - 2026 UR - https://arxiv.org/abs/2605.23997 ID - 2605.23997 ER -