6 citations · 15 across the 9 of their papers we have counts for
1 paper · 1 filter
Yi Zhang, Ce Zhang, Xueting Hu +1
Recently, large-scale pre-trained vision-language models (e.g. CLIP and ALIGN) have demonstrated remarkable effectiveness in acquiring transferable visual representations. To lever…