2 papers
cs.CV2025
Constrained Prompt Enhancement for Improving Zero-Shot Generalization of Vision-Language Models
Xiaojie Yin, Qilong Wang, Qinghua Hu
Vision-language models (VLMs) pre-trained on web-scale data exhibit promising zero-shot generalization but often suffer from semantic misalignment due to domain gaps between pre-tr…
cs.CV2024
: Synonymous Semantic Space for Improving Zero-Shot Generalization of Vision-Language Models
Xiaojie Yin, Qilong Wang, Bing Cao +1
Recently, many studies have been conducted to enhance the zero-shot generalization ability of vision-language models (e.g., CLIP) by addressing the semantic misalignment between im…