TY - RPRT TI - Eureka: Human-Level Reward Design via Coding Large Language Models AU - Yecheng Jason Ma AU - William Liang AU - Guanzhi Wang AU - De-An Huang AU - Osbert Bastani AU - Dinesh Jayaraman AU - Yuke Zhu AU - Linxi Fan AU - Anima Anandkumar PY - 2024 UR - https://arxiv.org/abs/2310.12931 ID - 2310.12931 ER -