1 paper
Zhiwei Li, Jiacheng Xue, Weining Wang +4
Vision-language models like CLIP have demonstrated remarkable zero-shot transfer capabilities. However, their susceptibility to imperceptible adversarial perturbations remains a cr…