TY - RPRT TI - HiPER: Hierarchical Reinforcement Learning with Explicit Credit Assignment for Large Language Model Agents AU - Jiangweizhi Peng AU - Yuanxin Liu AU - Ruida Zhou AU - Charles Fleming AU - Zhaoran Wang AU - Alfredo Garcia AU - Mingyi Hong PY - 2026 UR - https://arxiv.org/abs/2602.16165 ID - 2602.16165 ER -