TY - RPRT TI - Scaling Medical Reasoning Verification via Tool-Integrated Reinforcement Learning AU - Hang Zhang AU - Ruheng Wang AU - Yuelyu Ji AU - Mingu Kwak AU - Xizhi Wu AU - Chenyu Li AU - Li Zhang AU - Wenqi Shi AU - Yifan Peng AU - Yanshan Wang PY - 2026 UR - https://arxiv.org/abs/2601.20221 ID - 2601.20221 ER -