1 paper
Xuanhui Lin, Junhao Dong, Mingrong Gong +3
Vision-language models (VLMs) exhibit strong generalization across multimodal tasks but remain vulnerable to adversarial perturbations. Existing attacks typically follow single-tra…