TY - RPRT TI - Average-Reward Reinforcement Learning for Multichain MDPs: A Hierarchical Decomposition Approach AU - Huizhen Yu AU - Isaiah Heidt PY - 2026 UR - https://arxiv.org/abs/2610.10326 ID - 2610.10326 ER -