@misc{indiciae9f417b1fecdc, title = {Average-Reward Reinforcement Learning for Multichain MDPs: A Hierarchical Decomposition Approach}, author = {Huizhen Yu and Isaiah Heidt}, year = {2026}, url = {https://arxiv.org/abs/2610.10326}, note = {Source identifier: 2610.10326} }