TY - RPRT TI - Self-Refined Large Language Model as Automated Reward Function Designer for Deep Reinforcement Learning in Robotics AU - Jiayang Song AU - Zhehua Zhou AU - Jiawei Liu AU - Chunrong Fang AU - Zhan Shu AU - Lei Ma PY - 2023 UR - https://arxiv.org/abs/2309.06687 ID - 2309.06687 ER -