@misc{indiciaeac2bf1d5a468, title = {Gap-Increasing Policy Evaluation for Efficient and Noise-Tolerant Reinforcement Learning}, author = {Tadashi Kozuno and Dongqi Han and Kenji Doya}, year = {2019}, url = {https://arxiv.org/abs/1906.07586}, note = {Source identifier: 1906.07586} }