TY - RPRT TI - Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO AU - Blake Bullwinkel AU - Eugenia Kim AU - Amanda Minnich AU - Mark Russinovich PY - 2026 UR - https://arxiv.org/abs/2606.09701 ID - 2606.09701 ER -