TY - RPRT TI - SAM-R1: Leveraging SAM for Reward Feedback in Multimodal Segmentation via Reinforcement Learning AU - Jiaqi Huang AU - Zunnan Xu AU - Jun Zhou AU - Ting Liu AU - Yicheng Xiao AU - Mingwen Ou AU - Bowen Ji AU - Xiu Li AU - Kehong Yuan PY - 2026 UR - https://arxiv.org/abs/2505.22596 ID - 2505.22596 ER -