TY - RPRT TI - Retroformer: Retrospective Large Language Agents with Policy Gradient Optimization AU - Weiran Yao AU - Shelby Heinecke AU - Juan Carlos Niebles AU - Zhiwei Liu AU - Yihao Feng AU - Le Xue AU - Rithesh Murthy AU - Zeyuan Chen AU - Jianguo Zhang AU - Devansh Arpit AU - Ran Xu AU - Phil Mui AU - Huan Wang AU - Caiming Xiong AU - Silvio Savarese PY - 2024 UR - https://arxiv.org/abs/2308.02151 ID - 2308.02151 ER -