TY - RPRT TI - On Reward-Free RL with Kernel and Neural Function Approximations: Single-Agent MDP and Markov Game AU - Shuang Qiu AU - Jieping Ye AU - Zhaoran Wang AU - Zhuoran Yang PY - 2022 UR - https://arxiv.org/abs/2110.09771 ID - 2110.09771 ER -