TY - RPRT TI - Adversarial Reinforcement Learning for Large Language Model Agent Safety AU - Zizhao Wang AU - Dingcheng Li AU - Vaishakh Keshava AU - Phillip Wallis AU - Ananth Balashankar AU - Peter Stone AU - Lukas Rutishauser PY - 2025 UR - https://arxiv.org/abs/2510.05442 ID - 2510.05442 ER -