@misc{indiciae09233770df2e, title = {Med-U1: Incentivizing Unified Medical Reasoning in LLMs via Large-scale Reinforcement Learning}, author = {Xiaotian Zhang and Yuan Wang and Zhaopeng Feng and Ruizhe Chen and Zhijie Zhou and Yan Zhang and Hongxia Xu and Jian Wu and Zuozhu Liu}, year = {2025}, url = {https://arxiv.org/abs/2506.12307}, note = {Source identifier: 2506.12307} }