1 paper
Jia Deng, Jin Li, Zhenhua Zhao +1
Vision-Language Models (VLMs), such as CLIP, have demonstrated remarkable zero-shot generalizability across diverse downstream tasks. However, recent studies have revealed that VLM…