TY - RPRT TI - RewardMap: Tackling Sparse Rewards in Fine-grained Visual Reasoning via Multi-Stage Reinforcement Learning AU - Sicheng Feng AU - Kaiwen Tuo AU - Song Wang AU - Lingdong Kong AU - Jianke Zhu AU - Huan Wang PY - 2026 UR - https://arxiv.org/abs/2510.02240 ID - 2510.02240 ER -