TY - RPRT TI - Regularized Anderson Acceleration for Off-Policy Deep Reinforcement Learning AU - Wenjie Shi AU - Shiji Song AU - Hui Wu AU - Ya-Chu Hsu AU - Cheng Wu AU - Gao Huang PY - 2021 UR - https://arxiv.org/abs/1909.03245 ID - 1909.03245 ER -