@misc{indiciae2498b9534fb9, title = {Model-free Reinforcement Learning in Infinite-horizon Average-reward Markov Decision Processes}, author = {Chen-Yu Wei and Mehdi Jafarnia-Jahromi and Haipeng Luo and Hiteshi Sharma and Rahul Jain}, year = {2020}, url = {https://arxiv.org/abs/1910.07072}, note = {Source identifier: 1910.07072} }