TY - RPRT TI - Unmasking Backdoors: An Explainable Defense via Gradient-Attention Anomaly Scoring for Pre-trained Language Models AU - Anindya Sundar Das AU - Kangjie Chen AU - Monowar Bhuyan PY - 2026 UR - https://arxiv.org/abs/2510.04347 ID - 2510.04347 ER -