@misc{indiciae8a0aa41f27c6, title = {Adversary-Aware DPO: Enhancing Safety Alignment in Vision Language Models via Adversarial Training}, author = {Fenghua Weng and Jian Lou and Jun Feng and Minlie Huang and Wenjie Wang}, year = {2025}, url = {https://arxiv.org/abs/2502.11455}, note = {Source identifier: 2502.11455} }