1 paper · 1 filter
Pengxiao Han, Changkun Ye, Yanshuo Wang +5
Vision-language models like Contrastive Language-Image Pre-Training (CLIP) have been extensively studied in data-scarce scenarios. A particularly challenging and realistic task in…