1 paper
Nir Yellinek, Leonid Karlinsky, Raja Giryes
Vision-Language models (VLMs) have proven to be effective at aligning image and text representations, producing superior zero-shot results when transferred to many downstream tasks…