@misc{indiciaedaecd19edbfd, title = {Language Models as Efficient Reward Function Searchers for Custom-Environment Multi-Objective Reinforcement}, author = {Guanwen Xie and Jingzehua Xu and Yiyuan Yang and Yimian Ding and Shuai Zhang}, year = {2026}, url = {https://arxiv.org/abs/2409.02428}, note = {Source identifier: 2409.02428} }