TY - RPRT TI - DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning AU - DeepSeek-AI AU - Daya Guo AU - Dejian Yang AU - Haowei Zhang AU - Junxiao Song AU - Peiyi Wang AU - Qihao Zhu AU - Runxin Xu AU - Ruoyu Zhang AU - Shirong Ma AU - Xiao Bi AU - Xiaokang Zhang AU - Xingkai Yu AU - Yu Wu AU - Z. F. Wu AU - Zhibin Gou AU - Zhihong Shao AU - Zhuoshu Li AU - Ziyi Gao AU - Aixin Liu AU - Bing Xue AU - Bingxuan Wang AU - Bochao Wu AU - Bei Feng AU - Chengda Lu AU - Chenggang Zhao AU - Chengqi Deng AU - Chenyu Zhang AU - Chong Ruan AU - Damai Dai AU - Deli Chen AU - Dongjie Ji AU - Erhang Li AU - Fangyun Lin AU - Fucong Dai AU - Fuli Luo AU - Guangbo Hao AU - Guanting Chen AU - Guowei Li AU - H. Zhang AU - Han Bao AU - Hanwei Xu AU - Haocheng Wang AU - Honghui Ding AU - Huajian Xin AU - Huazuo Gao AU - Hui Qu AU - Hui Li AU - Jianzhong Guo AU - Jiashi Li AU - Jiawei Wang AU - Jingchang Chen AU - Jingyang Yuan AU - Junjie Qiu AU - Junlong Li AU - J. L. Cai AU - Jiaqi Ni AU - Jian Liang AU - Jin Chen AU - Kai Dong AU - Kai Hu AU - Kaige Gao AU - Kang Guan AU - Kexin Huang AU - Kuai Yu AU - Lean Wang AU - Lecong Zhang AU - Liang Zhao AU - Litong Wang AU - Liyue Zhang AU - Lei Xu AU - Leyi Xia AU - Mingchuan Zhang AU - Minghua Zhang AU - Minghui Tang AU - Meng Li AU - Miaojun Wang AU - Mingming Li AU - Ning Tian AU - Panpan Huang AU - Peng Zhang AU - Qiancheng Wang AU - Qinyu Chen AU - Qiushi Du AU - Ruiqi Ge AU - Ruisong Zhang AU - Ruizhe Pan AU - Runji Wang AU - R. J. Chen AU - R. L. Jin AU - Ruyi Chen AU - Shanghao Lu AU - Shangyan Zhou AU - Shanhuang Chen AU - Shengfeng Ye AU - Shiyu Wang AU - Shuiping Yu AU - Shunfeng Zhou AU - Shuting Pan AU - S. S. Li PY - 2026 DO - 10.1038/s41586-025-09422-z UR - https://arxiv.org/abs/2501.12948 ID - 2501.12948 ER -