@misc{indiciae3d06bd956a62, title = {EvoRS: On-Policy Self-Evolution of Reward Systems for Open-Ended Reinforcement Learning}, author = {Weiyuan Li and Aili Chen and Xintao Wang and Yikai Zhang and Qingqing Dong and Jinghan Xu and Hongru Hou and Wenxuan Zhao and Chengkun Lang and Jun Gao and Yuanli Guo and Hongcheng Guo and Yanghua Xiao and Deqing Yang}, year = {2026}, url = {https://arxiv.org/abs/2609.12459}, note = {Source identifier: 2609.12459} }