@misc{indiciae964e17d1d1d5, title = {SafeBehavior: Simulating Human-Like Multistage Reasoning to Mitigate Jailbreak Attacks in Large Language Models}, author = {Qinjian Zhao and Jiaqi Wang and Zhiqiang Gao and Zhihao Dou and Belal Abuhaija and Kaizhu Huang}, year = {2025}, url = {https://arxiv.org/abs/2509.26345}, note = {Source identifier: 2509.26345} }