1 paper
Dahyun Chung, Donghyun Shin, Yujin Sung +3
Contrastive Language-Image Pre-training (CLIP) has demonstrated strong generalization across a wide range of visual tasks by leveraging large-scale English-image pairs. However, it…