TY - RPRT TI - Nearly Minimax Optimal Reward-free Reinforcement Learning AU - Zihan Zhang AU - Simon S. Du AU - Xiangyang Ji PY - 2020 UR - https://arxiv.org/abs/2010.05901 ID - 2010.05901 ER -