TY - RPRT TI - Text2Reward: Reward Shaping with Language Models for Reinforcement Learning AU - Tianbao Xie AU - Siheng Zhao AU - Chen Henry Wu AU - Yitao Liu AU - Qian Luo AU - Victor Zhong AU - Yanchao Yang AU - Tao Yu PY - 2024 UR - https://arxiv.org/abs/2309.11489 ID - 2309.11489 ER -