TY - RPRT TI - Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning AU - Sheng Zhang AU - Qianchu Liu AU - Guanghui Qin AU - Tristan Naumann AU - Hoifung Poon PY - 2025 UR - https://arxiv.org/abs/2502.19655 ID - 2502.19655 ER -