@misc{indiciae2eb91f0b569a, title = {Rectify Evaluation Preference: Improving LLMs' Critique on Math Reasoning via Perplexity-aware Reinforcement Learning}, author = {Changyuan Tian and Zhicong Lu and Shuang Qian and Nayu Liu and Peiguang Li and Li Jin and Leiyi Hu and Zhizhao Zeng and Sirui Wang and Ke Zeng and Zhi Guo}, year = {2025}, url = {https://arxiv.org/abs/2511.10303}, note = {Source identifier: 2511.10303} }