TY - RPRT TI - DeepSeek-Prover-V2: Advancing Formal Mathematical Reasoning via Reinforcement Learning for Subgoal Decomposition AU - Z. Z. Ren AU - Zhihong Shao AU - Junxiao Song AU - Huajian Xin AU - Haocheng Wang AU - Wanjia Zhao AU - Liyue Zhang AU - Zhe Fu AU - Qihao Zhu AU - Dejian Yang AU - Z. F. Wu AU - Zhibin Gou AU - Shirong Ma AU - Hongxuan Tang AU - Yuxuan Liu AU - Wenjun Gao AU - Daya Guo AU - Chong Ruan PY - 2025 UR - https://arxiv.org/abs/2504.21801 ID - 2504.21801 ER -