TY - RPRT TI - Optimal Non-Asymptotic Rates of Value Iteration for Average-Reward Markov Decision Processes AU - Jongmin Lee AU - Ernest K. Ryu PY - 2026 UR - https://arxiv.org/abs/2504.09913 ID - 2504.09913 ER -