TY - RPRT TI - Leveraging Analytic Gradients in Provably Safe Reinforcement Learning AU - Tim Walter AU - Hannah Markgraf AU - Jonathan Külz AU - Matthias Althoff PY - 2026 DO - 10.1109/ojcsys.2025.3607845 UR - https://arxiv.org/abs/2506.01665 ID - 2506.01665 ER -