@misc{indiciaefa867b0d0817, title = {MCPO: Mastery-Consolidated Policy Optimization for Large Reasoning Models}, author = {Zhaokang Liao and Yingguo Gao and Yi Yang and Yongheng Hu and Jingting Ding}, year = {2026}, url = {https://arxiv.org/abs/2604.16972}, note = {Source identifier: 2604.16972} }