@misc{indiciaebabe29317d75, title = {Enhancing Large Language Model Reasoning with Reward Models: An Analytical Survey}, author = {Qiyuan Liu and Hao Xu and Xuhong Chen and Wei Chen and Yee Whye Teh and Ning Miao}, year = {2026}, url = {https://arxiv.org/abs/2510.01925}, note = {Source identifier: 2510.01925} }