1 paper
Ruiming Chen, Junming Yang, Shiyu Xia +3
CLIP (Contrastive Language-Image Pre-training) has attracted widespread attention for its multimodal generalizable knowledge, which is significant for downstream tasks. However, th…