TY - RPRT TI - SafeBehavior: Simulating Human-Like Multistage Reasoning to Mitigate Jailbreak Attacks in Large Language Models AU - Qinjian Zhao AU - Jiaqi Wang AU - Zhiqiang Gao AU - Zhihao Dou AU - Belal Abuhaija AU - Kaizhu Huang PY - 2025 UR - https://arxiv.org/abs/2509.26345 ID - 2509.26345 ER -