@misc{indiciae096597e93c39, title = {Feedback-based Modal Mutual Search for Attacking Vision-Language Pre-training Models}, author = {Renhua Ding and Xinze Zhang and Xiao Yang and Kun He}, year = {2024}, url = {https://arxiv.org/abs/2409.06726}, note = {Source identifier: 2409.06726} }