TY - RPRT TI - Near-Optimal Provable Uniform Convergence in Offline Policy Evaluation for Reinforcement Learning AU - Ming Yin AU - Yu Bai AU - Yu-Xiang Wang PY - 2020 UR - https://arxiv.org/abs/2007.03760 ID - 2007.03760 ER -