@misc{indiciae3723db641203, title = {Alignment and Safety in Large Language Models: Safety Mechanisms, Training Paradigms, and Emerging Challenges}, author = {Haoran Lu and Luyang Fang and Ruidong Zhang and Xinliang Li and Jiazhang Cai and Huimin Cheng and Lin Tang and Ziyu Liu and Zeliang Sun and Tao Wang and Yingchuan Zhang and Arif Hassan Zidan and Jinwen Xu and Jincheng Yu and Meizhi Yu and Hanqi Jiang and Xilin Gong and Weidi Luo and Bolun Sun and Yongkai Chen and Terry Ma and Shushan Wu and Yifan Zhou and Junhao Chen and Haotian Xiang and Jing Zhang and Afrar Jahin and Wei Ruan and Ke Deng and Yi Pan and Peilong Wang and Jiahui Li and Zhengliang Liu and Lu Zhang and Lin Zhao and Wei Liu and Dajiang Zhu and Xin Xing and Fei Dou and Wei Zhang and Chao Huang and Rongjie Liu and Mengrui Zhang and Yiwen Liu and Xiaoxiao Sun and Qin Lu and Zhen Xiang and Wenxuan Zhong and Tianming Liu and Ping Ma}, year = {2025}, url = {https://arxiv.org/abs/2507.19672}, note = {Source identifier: 2507.19672} }