@misc{indiciae82faba508940, title = {Never Worse, Mostly Better: Stable Policy Improvement in Deep Reinforcement Learning}, author = {Pranav Khanna and Guy Tennenholtz and Nadav Merlis and Shie Mannor and Chen Tessler}, year = {2022}, url = {https://arxiv.org/abs/1910.01062}, note = {Source identifier: 1910.01062} }