1 paper
Jian Liang, Lijun Sheng, Zhengbo Wang +2
The emergence of vision-language models, such as CLIP, has spurred a significant research effort towards their application for downstream supervised learning tasks. Although some p…