Unveiling the Fragility of Vision-Language Models: Multi-Modal Adversarial Synergy via Texture-Constrained Perturbations and Cross-Modal Optimization.
Xiang Fang, Wanlong Fang, Changshuo Wang
Browse the full AAAI paper archive.
Xiang Fang, Wanlong Fang, Changshuo Wang
Browse the full AAAI paper archive.