@misc{indiciae654a68959f68, title = {Jailbreaking Large Language Models Against Moderation Guardrails via Cipher Characters}, author = {Haibo Jin and Andy Zhou and Joe D. Menke and Haohan Wang}, year = {2024}, url = {https://arxiv.org/abs/2405.20413}, note = {Source identifier: 2405.20413} }