TY - RPRT TI - Provably Safe, Yet Scalable Reinforcement Learning AU - Kai S. Yun AU - Zeyang Li AU - Navid Azizan PY - 2026 UR - https://arxiv.org/abs/2606.14536 ID - 2606.14536 ER -