@misc{indiciae2d6704c08a83, title = {Unveiling the Fragility of Vision-Language Models: Multi-Modal Adversarial Synergy via Texture-Constrained Perturbations and Cross-Modal Optimization}, author = {Xiang Fang and Wanlong Fang and Changshuo Wang}, year = {2026}, url = {https://arxiv.org/abs/2605.26501}, note = {Source identifier: 2605.26501} }