TY - RPRT TI - Provably Efficient Infinite-Horizon Average-Reward Reinforcement Learning with Linear Function Approximation AU - Woojin Chae AU - Dabeen Lee PY - 2024 UR - https://arxiv.org/abs/2409.10772 ID - 2409.10772 ER -