1 paper
Jie Guo, Qimeng Wang, Yan Gao +4
CLIP (Contrastive Language-Image Pretraining) is well-developed for open-vocabulary zero-shot image-level recognition, while its applications in pixel-level tasks are less investig…