TY - RPRT TI - Efficient Agentic Reinforcement Learning with On-Policy Intrinsic Knowledge Boundary Enhancement AU - Dingwei Chen AU - Zefang Zong AU - Zhipeng Ma AU - Leo Luo AU - Yang Li AU - Chengming Li AU - Peng Chen AU - Jie Jiang PY - 2026 UR - https://arxiv.org/abs/2605.26952 ID - 2605.26952 ER -