TY - RPRT TI - Reward-Free RL is No Harder Than Reward-Aware RL in Linear Markov Decision Processes AU - Andrew Wagenmaker AU - Yifang Chen AU - Max Simchowitz AU - Simon S. Du AU - Kevin Jamieson PY - 2022 UR - https://arxiv.org/abs/2201.11206 ID - 2201.11206 ER -