@misc{indiciae6a1cd6238784, title = {Circumventing Safety Alignment in Large Language Models Through Embedding Space Toxicity Attenuation}, author = {Zhibo Zhang and Yuxi Li and Kailong Wang and Shuai Yuan and Ling Shi and Haoyu Wang}, year = {2025}, url = {https://arxiv.org/abs/2507.08020}, note = {Source identifier: 2507.08020} }