TY - RPRT TI - Supervised Policy Update for Deep Reinforcement Learning AU - Quan Vuong AU - Yiming Zhang AU - Keith W. Ross PY - 2018 UR - https://arxiv.org/abs/1805.11706 ID - 1805.11706 ER -