1 citations · 1 across the 3 of their papers we have counts for
1 paper · 1 filter
Jia Deng, Jin Li, Zhenhua Zhao +1
Vision-Language Models (VLMs), such as CLIP, have demonstrated remarkable zero-shot generalizability across diverse downstream tasks. However, recent studies have revealed that VLM…