1 paper
Samyak Rawlekar, Shubhang Bhatnagar, Narendra Ahuja
Vision-language models (VLMs) like CLIP have been adapted for Multi-Label Recognition (MLR) with partial annotations by leveraging prompt-learning, where positive and negative prom…