@misc{indiciae4f433a59bdba, title = {Interpolated Policy Gradient: Merging On-Policy and Off-Policy Gradient Estimation for Deep Reinforcement Learning}, author = {Shixiang Gu and Timothy Lillicrap and Zoubin Ghahramani and Richard E. Turner and Bernhard Schölkopf and Sergey Levine}, year = {2017}, url = {https://arxiv.org/abs/1706.00387}, note = {Source identifier: 1706.00387} }