1 paper
Dexia Chen, Wentao Zhang, Qianjie Zhu +4
Vision-language models (VLMs) pre-trained on natural image and language data, such as CLIP, have exhibited significant potential in few-shot image recognition tasks, leading to dev…