TY - RPRT TI - Making Deep Q-learning methods robust to time discretization AU - Corentin Tallec AU - Léonard Blier AU - Yann Ollivier PY - 2019 UR - https://arxiv.org/abs/1901.09732 ID - 1901.09732 ER -