TY - RPRT TI - Learning to Play in a Day: Faster Deep Reinforcement Learning by Optimality Tightening AU - Frank S. He AU - Yang Liu AU - Alexander G. Schwing AU - Jian Peng PY - 2016 UR - https://arxiv.org/abs/1611.01606 ID - 1611.01606 ER -