TY - RPRT TI - Alignment and Safety in Large Language Models: Safety Mechanisms, Training Paradigms, and Emerging Challenges AU - Haoran Lu AU - Luyang Fang AU - Ruidong Zhang AU - Xinliang Li AU - Jiazhang Cai AU - Huimin Cheng AU - Lin Tang AU - Ziyu Liu AU - Zeliang Sun AU - Tao Wang AU - Yingchuan Zhang AU - Arif Hassan Zidan AU - Jinwen Xu AU - Jincheng Yu AU - Meizhi Yu AU - Hanqi Jiang AU - Xilin Gong AU - Weidi Luo AU - Bolun Sun AU - Yongkai Chen AU - Terry Ma AU - Shushan Wu AU - Yifan Zhou AU - Junhao Chen AU - Haotian Xiang AU - Jing Zhang AU - Afrar Jahin AU - Wei Ruan AU - Ke Deng AU - Yi Pan AU - Peilong Wang AU - Jiahui Li AU - Zhengliang Liu AU - Lu Zhang AU - Lin Zhao AU - Wei Liu AU - Dajiang Zhu AU - Xin Xing AU - Fei Dou AU - Wei Zhang AU - Chao Huang AU - Rongjie Liu AU - Mengrui Zhang AU - Yiwen Liu AU - Xiaoxiao Sun AU - Qin Lu AU - Zhen Xiang AU - Wenxuan Zhong AU - Tianming Liu AU - Ping Ma PY - 2025 UR - https://arxiv.org/abs/2507.19672 ID - 2507.19672 ER -