@misc{indiciae2c8c1044a0bd, title = {Learning Value Functions in Deep Policy Gradients using Residual Variance}, author = {Yannis Flet-Berliac and Reda Ouhamma and Odalric-Ambrym Maillard and Philippe Preux}, year = {2021}, url = {https://arxiv.org/abs/2010.04440}, note = {Source identifier: 2010.04440} }