TY - RPRT TI - Safety Generalization Under Distribution Shift in Safe Reinforcement Learning: A Diabetes Testbed AU - Minjae Kwon AU - Josephine Lamp AU - Lu Feng PY - 2026 UR - https://arxiv.org/abs/2601.21094 ID - 2601.21094 ER -