TY - RPRT TI - Latent Jailbreak: A Benchmark for Evaluating Text Safety and Output Robustness of Large Language Models AU - Huachuan Qiu AU - Shuai Zhang AU - Anqi Li AU - Hongliang He AU - Zhenzhong Lan PY - 2023 UR - https://arxiv.org/abs/2307.08487 ID - 2307.08487 ER -