TY - RPRT TI - Model-free Reinforcement Learning in Infinite-horizon Average-reward Markov Decision Processes AU - Chen-Yu Wei AU - Mehdi Jafarnia-Jahromi AU - Haipeng Luo AU - Hiteshi Sharma AU - Rahul Jain PY - 2020 UR - https://arxiv.org/abs/1910.07072 ID - 1910.07072 ER -