TY - RPRT TI - Verifiable Reinforcement Learning via Policy Extraction AU - Osbert Bastani AU - Yewen Pu AU - Armando Solar-Lezama PY - 2019 UR - https://arxiv.org/abs/1805.08328 ID - 1805.08328 ER -