TY - RPRT TI - Sharper Model-free Reinforcement Learning for Average-reward Markov Decision Processes AU - Zihan Zhang AU - Qiaomin Xie PY - 2023 UR - https://arxiv.org/abs/2306.16394 ID - 2306.16394 ER -