TY - RPRT TI - Improving Retrospective Language Agents via Joint Policy Gradient Optimization AU - Xueyang Feng AU - Bo Lan AU - Quanyu Dai AU - Lei Wang AU - Jiakai Tang AU - Xu Chen AU - Zhenhua Dong AU - Ji-Rong Wen PY - 2025 UR - https://arxiv.org/abs/2503.01490 ID - 2503.01490 ER -