TY - RPRT TI - Circumventing Safety Alignment in Large Language Models Through Embedding Space Toxicity Attenuation AU - Zhibo Zhang AU - Yuxi Li AU - Kailong Wang AU - Shuai Yuan AU - Ling Shi AU - Haoyu Wang PY - 2025 UR - https://arxiv.org/abs/2507.08020 ID - 2507.08020 ER -