TY - RPRT TI - Resolving Action Bottleneck: Agentic Reinforcement Learning Informed by Token-Level Energy AU - Langzhou He AU - Junyou Zhu AU - Yue Zhou AU - Zhengyao Gu AU - Junhua Liu AU - Wei-Chieh Huang AU - Henry Peng Zou AU - David Wipf AU - Philip S. Yu AU - Qitian Wu PY - 2026 UR - https://arxiv.org/abs/2605.14558 ID - 2605.14558 ER -