TY - RPRT TI - Directional Constraints for Efficient Exploration in Safe Reinforcement Learning AU - Paolo Magliano AU - Puze Liu AU - Jan Peters AU - Davide Tateo AU - Raffaello Camoriano PY - 2026 UR - https://arxiv.org/abs/2607.12784 ID - 2607.12784 ER -