@misc{indiciae715e0d437a7f, title = {Finite-Sample Analysis of Policy Evaluation for Robust Average Reward Reinforcement Learning}, author = {Yang Xu and Washim Uddin Mondal and Vaneet Aggarwal}, year = {2025}, url = {https://arxiv.org/abs/2502.16816}, note = {Source identifier: 2502.16816} }