TY - RPRT TI - Large Language Model as a Policy Teacher for Training Reinforcement Learning Agents AU - Zihao Zhou AU - Bin Hu AU - Chenyang Zhao AU - Pu Zhang AU - Bin Liu PY - 2024 UR - https://arxiv.org/abs/2311.13373 ID - 2311.13373 ER -