TY - RPRT TI - First-Order Regret in Reinforcement Learning with Linear Function Approximation: A Robust Estimation Approach AU - Andrew Wagenmaker AU - Yifang Chen AU - Max Simchowitz AU - Simon S. Du AU - Kevin Jamieson PY - 2022 UR - https://arxiv.org/abs/2112.03432 ID - 2112.03432 ER -