TY - RPRT TI - Beyond Exponentially Fast Mixing in Average-Reward Reinforcement Learning via Multi-Level Monte Carlo Actor-Critic AU - Wesley A. Suttle AU - Amrit Singh Bedi AU - Bhrij Patel AU - Brian M. Sadler AU - Alec Koppel AU - Dinesh Manocha PY - 2023 UR - https://arxiv.org/abs/2301.12083 ID - 2301.12083 ER -