TY - RPRT TI - Fine-tuning Aligned Language Models Compromises Safety, Even When Users Do Not Intend To! AU - Xiangyu Qi AU - Yi Zeng AU - Tinghao Xie AU - Pin-Yu Chen AU - Ruoxi Jia AU - Prateek Mittal AU - Peter Henderson PY - 2023 UR - https://arxiv.org/abs/2310.03693 ID - 2310.03693 ER -