@misc{indiciae2009d3e839a9, title = {NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning}, author = {Wei Liu and Siya Qi and Xinyu Wang and Chen Qian and Yali Du and Yulan He}, year = {2025}, url = {https://arxiv.org/abs/2505.16022}, note = {Source identifier: 2505.16022} }