TY - RPRT TI - Full Gradient DQN Reinforcement Learning: A Provably Convergent Scheme AU - K. E. Avrachenkov AU - V. S. Borkar AU - H. P. Dolhare AU - K. Patil PY - 2021 DO - 10.1007/978-3-030-76928-4_10 UR - https://arxiv.org/abs/2103.05981 ID - 2103.05981 ER -