TY - RPRT TI - Robust Average-Reward Markov Decision Processes: Minimax-Optimal Learning via Plug-in Reductions AU - Yuepeng Yang AU - Yuxin Chen AU - Yuejie Chi PY - 2026 UR - https://arxiv.org/abs/2608.06545 ID - 2608.06545 ER -