TY - RPRT TI - Entropy Pacing Policy Optimization for Multi-Task Agentic Reinforcement Learning AU - Zetian Hu AU - Shunyu Liu AU - Junjie Zhang AU - Yongcheng Jing AU - Ting-En Lin AU - Yongbin Li AU - Dacheng Tao PY - 2026 UR - https://arxiv.org/abs/2607.07178 ID - 2607.07178 ER -