TY - RPRT TI - RRO: LLM Agent Optimization Through Rising Reward Trajectories AU - Zilong Wang AU - Jingfeng Yang AU - Sreyashi Nag AU - Samarth Varshney AU - Xianfeng Tang AU - Haoming Jiang AU - Jingbo Shang AU - Sheikh Muhammad Sarwar PY - 2025 UR - https://arxiv.org/abs/2505.20737 ID - 2505.20737 ER -