TY - RPRT TI - Agent-Driven Autonomous Reinforcement Learning Research: Iterative Policy Improvement for Quadruped Locomotion AU - Nimesh Khandelwal AU - Shakti S. Gupta PY - 2026 UR - https://arxiv.org/abs/2603.27416 ID - 2603.27416 ER -