TY - RPRT TI - Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model? AU - Yang Yue AU - Zhiqi Chen AU - Rui Lu AU - Andrew Zhao AU - Zhaokai Wang AU - Shiji Song AU - Gao Huang PY - 2025 UR - https://arxiv.org/abs/2504.13837 ID - 2504.13837 ER -