TY - RPRT TI - "Not Aligned" is Not "Malicious": Being Careful about Hallucinations of Large Language Models' Jailbreak AU - Lingrui Mei AU - Shenghua Liu AU - Yiwei Wang AU - Baolong Bi AU - Jiayi Mao AU - Xueqi Cheng PY - 2025 UR - https://arxiv.org/abs/2406.11668 ID - 2406.11668 ER -