TY - RPRT TI - Beyond SFT: Reinforcement Learning for Safer Large Reasoning Models with Better Reasoning Ability AU - Jinghan Jia AU - Nathalie Baracaldo AU - Sijia Liu PY - 2025 UR - https://arxiv.org/abs/2512.01848 ID - 2512.01848 ER -