TY - RPRT TI - Med-U1: Incentivizing Unified Medical Reasoning in LLMs via Large-scale Reinforcement Learning AU - Xiaotian Zhang AU - Yuan Wang AU - Zhaopeng Feng AU - Ruizhe Chen AU - Zhijie Zhou AU - Yan Zhang AU - Hongxia Xu AU - Jian Wu AU - Zuozhu Liu PY - 2025 UR - https://arxiv.org/abs/2506.12307 ID - 2506.12307 ER -