1 paper · 1 filter
Nir Yellinek, Leonid Karlinsky, Raja Giryes
Vision-Language models (VLMs) have proven to be effective at aligning image and text representations, producing superior zero-shot results when transferred to many downstream tasks…