TY - RPRT TI - Large Language Models Are Involuntary Truth-Tellers: Exploiting Fallacy Failure for Jailbreak Attacks AU - Yue Zhou AU - Henry Peng Zou AU - Barbara Di Eugenio AU - Yang Zhang PY - 2025 UR - https://arxiv.org/abs/2407.00869 ID - 2407.00869 ER -