1 paper · 1 filter
Michael Ogezi, Bradley Hauer, Grzegorz Kondrak
Language-vision models like CLIP have made significant strides in vision tasks, such as zero-shot image classification (ZSIC). However, generating specific and expressive visual de…