TY - RPRT TI - How to Discount Deep Reinforcement Learning: Towards New Dynamic Strategies AU - Vincent François-Lavet AU - Raphael Fonteneau AU - Damien Ernst PY - 2016 UR - https://arxiv.org/abs/1512.02011 ID - 1512.02011 ER -