TY - RPRT TI - Robust Safety Classifier for Large Language Models: Adversarial Prompt Shield AU - Jinhwa Kim AU - Ali Derakhshan AU - Ian G. Harris PY - 2023 UR - https://arxiv.org/abs/2311.00172 ID - 2311.00172 ER -