TY - RPRT TI - Correct-by-synthesis reinforcement learning with temporal logic constraints AU - Min Wen AU - Ruediger Ehlers AU - Ufuk Topcu PY - 2015 UR - https://arxiv.org/abs/1503.01793 ID - 1503.01793 ER -