TY - RPRT TI - Exploiting Estimation Bias in Clipped Double Q-Learning for Continous Control Reinforcement Learning Tasks AU - Niccolò Turcato AU - Alberto Sinigaglia AU - Alberto Dalla Libera AU - Ruggero Carli AU - Gian Antonio Susto PY - 2024 UR - https://arxiv.org/abs/2402.09078 ID - 2402.09078 ER -