@misc{indiciae4186abecec6b, title = {JBShield: Defending Large Language Models from Jailbreak Attacks through Activated Concept Analysis and Manipulation}, author = {Shenyi Zhang and Yuchen Zhai and Keyan Guo and Hongxin Hu and Shengnan Guo and Zheng Fang and Lingchen Zhao and Chao Shen and Cong Wang and Qian Wang}, year = {2025}, url = {https://arxiv.org/abs/2502.07557}, note = {Source identifier: 2502.07557} }