TY - RPRT TI - Probabilistic Counterexample Guidance for Safer Reinforcement Learning (Extended Version) AU - Xiaotong Ji AU - Antonio Filieri PY - 2023 UR - https://arxiv.org/abs/2307.04927 ID - 2307.04927 ER -