@misc{indiciae68edd62c977b, title = {Average-reward reinforcement learning in semi-Markov decision processes via relative value iteration}, author = {Huizhen Yu and Yi Wan and Richard S. Sutton}, year = {2025}, url = {https://arxiv.org/abs/2512.06218}, note = {Source identifier: 2512.06218} }