Showing cs.CVShow all
2 papers · 1 filter
cs.CV2026
Subspace Alignment for Vision-Language Model Test-time Adaptation
Zhichen Zeng, Wenxuan Bao, Xiao Lin +8
Vision-language models (VLMs), despite their extraordinary zero-shot capabilities, are vulnerable to distribution shifts. Test-time adaptation (TTA) emerges as a predominant strate…
cs.CV2024
Enhancing Vision-Language Models Generalization via Diversity-Driven Novel Feature Synthesis
Siyuan Yan, Cheng Luo, Zhen Yu +1
Vision-language foundation models like CLIP have shown impressive zero-shot generalization, but finetuning on downstream datasets can cause overfitting and loss of its generalizati…