@misc{indiciaee72d8b5957bd, title = {Towards Optimal Off-Policy Evaluation for Reinforcement Learning with Marginalized Importance Sampling}, author = {Tengyang Xie and Yifei Ma and Yu-Xiang Wang}, year = {2020}, url = {https://arxiv.org/abs/1906.03393}, note = {Source identifier: 1906.03393} }