TY - RPRT TI - Safetywashing: Do AI Safety Benchmarks Actually Measure Safety Progress? AU - Richard Ren AU - Steven Basart AU - Adam Khoja AU - Alice Gatti AU - Long Phan AU - Xuwang Yin AU - Mantas Mazeika AU - Alexander Pan AU - Gabriel Mukobi AU - Ryan H. Kim AU - Stephen Fitz AU - Dan Hendrycks PY - 2024 UR - https://arxiv.org/abs/2407.21792 ID - 2407.21792 ER -