TY - RPRT TI - Language Models are Homer Simpson! Safety Re-Alignment of Fine-tuned Language Models through Task Arithmetic AU - Rishabh Bhardwaj AU - Do Duc Anh AU - Soujanya Poria PY - 2024 UR - https://arxiv.org/abs/2402.11746 ID - 2402.11746 ER -