TY - RPRT TI - Safety Alignment of Large Language Models via Contrasting Safe and Harmful Distributions AU - Xiaoyun Zhang AU - Zhengyue Zhao AU - Wenxuan Shi AU - Kaidi Xu AU - Di Huang AU - Xing Hu PY - 2025 UR - https://arxiv.org/abs/2406.16743 ID - 2406.16743 ER -