TY - RPRT TI - Distillation Defenses Easily Break After Reinforcement Learning AU - Shidan Javaheri AU - Alexander Panfilov AU - Oliver Britton AU - Yarin Gal AU - Yonatan Gideoni PY - 2026 UR - https://arxiv.org/abs/2609.35699 ID - 2609.35699 ER -