1 paper · 1 filter
Chuanguang Yang, Zhulin An, Libo Huang +5
Contrastive Language-Image Pre-training (CLIP) has become a promising language-supervised visual pre-training framework. This paper aims to distill small CLIP models supervised by…