@misc{indiciae418f931b34f4, title = {Distributional Soft Actor-Critic: Off-Policy Reinforcement Learning for Addressing Value Estimation Errors}, author = {Jingliang Duan and Yang Guan and Shengbo Eben Li and Yangang Ren and Bo Cheng}, year = {2021}, doi = {10.1109/tnnls.2021.3082568}, url = {https://arxiv.org/abs/2001.02811}, note = {Source identifier: 2001.02811} }