1 paper
Wenyuan Yang, Yichen Sun, Changzheng Chen +4
Large-scale vision-language models, especially CLIP, have demonstrated remarkable performance across diverse downstream tasks. Soft prompts, as carefully crafted modules that effic…