TY - RPRT TI - Knowledgeable Agents by Offline Reinforcement Learning from Large Language Model Rollouts AU - Jing-Cheng Pang AU - Si-Hang Yang AU - Kaiyuan Li AU - Jiaji Zhang AU - Xiong-Hui Chen AU - Nan Tang AU - Yang Yu PY - 2024 UR - https://arxiv.org/abs/2404.09248 ID - 2404.09248 ER -