TY - RPRT TI - Agent Reinforcement Learning via Pivotal-Aware Self-Feedback Retry AU - Weiyang Guo AU - Zesheng Shi AU - Longhui Zhang AU - Zeen Zhu AU - Min Zhang AU - Jing Li PY - 2026 UR - https://arxiv.org/abs/2607.03702 ID - 2607.03702 ER -