@misc{indiciae7eb660b229c6, title = {Intrinsically Efficient, Stable, and Bounded Off-Policy Evaluation for Reinforcement Learning}, author = {Nathan Kallus and Masatoshi Uehara}, year = {2019}, url = {https://arxiv.org/abs/1906.03735}, note = {Source identifier: 1906.03735} }