TY - RPRT TI - A Large Language Model-Driven Reward Design Framework via Dynamic Feedback for Reinforcement Learning AU - Shengjie Sun AU - Runze Liu AU - Jiafei Lyu AU - Jing-Wen Yang AU - Liangpeng Zhang AU - Xiu Li PY - 2024 UR - https://arxiv.org/abs/2410.14660 ID - 2410.14660 ER -