@misc{indiciae7d4eb72957d2, title = {When Models Outthink Their Safety: Unveiling and Mitigating Self-Jailbreak in Large Reasoning Models}, author = {Yingzhi Mao and Chunkang Zhang and Junxiang Wang and Xinyan Guan and Boxi Cao and Yaojie Lu and Hongyu Lin and Xianpei Han and Le Sun}, year = {2026}, url = {https://arxiv.org/abs/2510.21285}, note = {Source identifier: 2510.21285} }