@misc{indiciaed822ed4e1ae2, title = {Adversarial Reinforcement Learning for Large Language Model Agent Safety}, author = {Zizhao Wang and Dingcheng Li and Vaishakh Keshava and Phillip Wallis and Ananth Balashankar and Peter Stone and Lukas Rutishauser}, year = {2025}, url = {https://arxiv.org/abs/2510.05442}, note = {Source identifier: 2510.05442} }