TY - RPRT TI - A Sharper Global Convergence Analysis for Average Reward Reinforcement Learning via an Actor-Critic Approach AU - Swetha Ganesh AU - Washim Uddin Mondal AU - Vaneet Aggarwal PY - 2025 UR - https://arxiv.org/abs/2407.18878 ID - 2407.18878 ER -