TY - RPRT TI - Antidote: Post-fine-tuning Safety Alignment for Large Language Models against Harmful Fine-tuning AU - Tiansheng Huang AU - Gautam Bhattacharya AU - Pratik Joshi AU - Josh Kimball AU - Ling Liu PY - 2025 UR - https://arxiv.org/abs/2408.09600 ID - 2408.09600 ER -