TY - RPRT TI - Double Actor-Critic with TD Error-Driven Regularization in Reinforcement Learning AU - Haohui Chen AU - Zhiyong Chen AU - Aoxiang Liu AU - Wentuo Fang PY - 2024 UR - https://arxiv.org/abs/2409.19231 ID - 2409.19231 ER -