1 paper
Aaditya Baranwal, Abdul Mueez, Jason Voelker +2
Large-scale Vision-Language Models (VLMs) have transformed general-purpose visual recognition through strong zero-shot capabilities. However, their performance degrades significant…