1 paper
Li Zeng, Zeyu Ye, Meng Xie +4
Vision-Language Models (VLMs) are known to be vulnerable to adversarial attacks, where subtle perturbations to images or texts induce erroneous outputs. However, most text-based at…