TY - RPRT TI - Reinforcement Learning for Infinite-Horizon Average-Reward Linear MDPs via Approximation by Discounted-Reward MDPs AU - Kihyuk Hong AU - Woojin Chae AU - Yufan Zhang AU - Dabeen Lee AU - Ambuj Tewari PY - 2025 UR - https://arxiv.org/abs/2405.15050 ID - 2405.15050 ER -