TY - RPRT TI - Safe Reinforcement Learning via Recovery-based Shielding with Gaussian Process Dynamics Models AU - Alexander W. Goodall AU - Francesco Belardinelli PY - 2026 UR - https://arxiv.org/abs/2602.12444 ID - 2602.12444 ER -