TY - RPRT TI - Provably Optimal Reinforcement Learning under Safety Filtering AU - Donggeon David Oh AU - Duy P. Nguyen AU - Haimin Hu AU - Jaime Fernández Fisac PY - 2026 DO - 10.1609/iaseai.v2i1.43046 UR - https://arxiv.org/abs/2510.18082 ID - 2510.18082 ER -