1 paper
Gustavo Adolfo Vargas Hakim, David Osowiechi, Mehrdad Noori +5
Pre-trained vision-language models (VLMs), exemplified by CLIP, demonstrate remarkable adaptability across zero-shot classification tasks without additional training. However, thei…