TY - RPRT TI - Baseline Defenses for Adversarial Attacks Against Aligned Language Models AU - Neel Jain AU - Avi Schwarzschild AU - Yuxin Wen AU - Gowthami Somepalli AU - John Kirchenbauer AU - Ping-yeh Chiang AU - Micah Goldblum AU - Aniruddha Saha AU - Jonas Geiping AU - Tom Goldstein PY - 2023 UR - https://arxiv.org/abs/2309.00614 ID - 2309.00614 ER -