TY - RPRT TI - Mitigating Adaptive Attacks against Reasoning Models with Activation Consistency Training AU - Avidan Shah AU - Jannik Brinkmann AU - Rico Angell PY - 2026 UR - https://arxiv.org/abs/2605.28467 ID - 2605.28467 ER -