@misc{indiciae9b0e8aa05c07, title = {RPO:Reinforcement Fine-Tuning with Partial Reasoning Optimization}, author = {Hongzhu Yi and Xinming Wang and Zhenghao zhang and Tianyu Zong and Yuanxiang Wang and Jun Xie and Tao Yu and Haopeng Jin and Kaixin Xu and Feng Chen and Jiahuan Chen and Yujia Yang and Zhenyu Guan and Bingkang Shi and Jungang Xu}, year = {2026}, url = {https://arxiv.org/abs/2601.19404}, note = {Source identifier: 2601.19404} }