TY - RPRT TI - Open-Reasoner-Zero: An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model AU - Jingcheng Hu AU - Yinmin Zhang AU - Qi Han AU - Daxin Jiang AU - Xiangyu Zhang AU - Heung-Yeung Shum PY - 2025 UR - https://arxiv.org/abs/2503.24290 ID - 2503.24290 ER -