1 paper
Zhiwei Li, Yitian Pang, Weining Wang +2
Vision-Language Models (VLMs), such as CLIP, have achieved impressive zero-shot recognition performance but remain highly susceptible to adversarial perturbations, posing significa…