@misc{indiciaed89275fabea2, title = {Safe and Efficient Off-Policy Reinforcement Learning}, author = {Rémi Munos and Tom Stepleton and Anna Harutyunyan and Marc G. Bellemare}, year = {2016}, url = {https://arxiv.org/abs/1606.02647}, note = {Source identifier: 1606.02647} }