TY - RPRT TI - Towards Comprehensive Post Safety Alignment of Large Language Models via Safety Patching AU - Weixiang Zhao AU - Yulin Hu AU - Zhuojun Li AU - Yang Deng AU - Jiahe Guo AU - Xingyu Sui AU - Yanyan Zhao AU - Bing Qin AU - Tat-Seng Chua AU - Ting Liu PY - 2024 UR - https://arxiv.org/abs/2405.13820 ID - 2405.13820 ER -