@misc{indiciae04a2ded055c4, title = {Off-Policy Actor-Critic in an Ensemble: Achieving Maximum General Entropy and Effective Environment Exploration in Deep Reinforcement Learning}, author = {Gang Chen and Yiming Peng}, year = {2019}, url = {https://arxiv.org/abs/1902.05551}, note = {Source identifier: 1902.05551} }