TY - RPRT TI - RoMeRL: Balancing Feedback Coverage and the Memory-Reward Trap in Self-Evolving Agent Memory via Reduced-Order Utility States AU - Yi Yang AU - Zhennan Chen AU - Yihong Zhuang AU - Tiehan Fan AU - Yinan Chen AU - Jian Li AU - Jian Yang AU - Ying Tai PY - 2026 UR - https://arxiv.org/abs/2608.02508 ID - 2608.02508 ER -