@misc{indiciaeb0fe9c9a2b3e, title = {Dropout Strategy in Reinforcement Learning: Limiting the Surrogate Objective Variance in Policy Optimization Methods}, author = {Zhengpeng Xie and Changdong Yu and Weizheng Qiao}, year = {2023}, url = {https://arxiv.org/abs/2310.20380}, note = {Source identifier: 2310.20380} }