TY - RPRT TI - Model-based Reinforcement Learning from Signal Temporal Logic Specifications AU - Parv Kapoor AU - Anand Balakrishnan AU - Jyotirmoy V. Deshmukh PY - 2020 UR - https://arxiv.org/abs/2011.04950 ID - 2011.04950 ER -