@misc{indiciae6dba34f86564, title = {Breaking the Safety-Capability Tradeoff: Reinforcement Learning with Verifiable Rewards Maintains Safety Guardrails in LLMs}, author = {Dongkyu Derek Cho and Huan Song and Arijit Ghosh Chowdhury and Haotian An and Yawei Wang and Rohit Thekkanal and Negin Sokhandan and Sharlina Keshava and Hannah Marlowe}, year = {2025}, url = {https://arxiv.org/abs/2511.21050}, note = {Source identifier: 2511.21050} }