TY - RPRT TI - Learning Infinite-horizon Average-reward MDPs with Linear Function Approximation AU - Chen-Yu Wei AU - Mehdi Jafarnia-Jahromi AU - Haipeng Luo AU - Rahul Jain PY - 2021 UR - https://arxiv.org/abs/2007.11849 ID - 2007.11849 ER -