TY - RPRT TI - Verified Probabilistic Policies for Deep Reinforcement Learning AU - Edoardo Bacci AU - David Parker PY - 2022 UR - https://arxiv.org/abs/2201.03698 ID - 2201.03698 ER -