TY - RPRT TI - Optimal Sample Complexity for Average Reward Markov Decision Processes AU - Shengbo Wang AU - Jose Blanchet AU - Peter Glynn PY - 2024 UR - https://arxiv.org/abs/2310.08833 ID - 2310.08833 ER -