TY - RPRT TI - Where-to-Learn: Analytical Policy Gradient Directed Exploration for On-Policy Robotic Reinforcement Learning AU - Leixin Chang AU - Xinchen Yao AU - Ben Liu AU - Liangjing Yang AU - Hua Chen PY - 2026 DO - 10.1109/lra.2026.3678143 UR - https://arxiv.org/abs/2603.27317 ID - 2603.27317 ER -