Showing cs.CVShow all
3 papers · 1 filter
cs.CV2026
Illusion-Aware Visual Preprocessing and Anti-Illusion Prompting for Classic Illusion Understanding in Vision-Language Models
Junli Zha, Jiahui Wang, Xinkai Lu +1
Vision-Language Models (VLMs) exhibit systematic bias toward visual illusions, recalling memorized facts rather than perceiving actual visual differences. This paper presents a tra…
cs.CV2025
Integrated Structural Prompt Learning for Vision-Language Models
Jiahui Wang, Qin Xu, Bo Jiang +1
Prompt learning methods have significantly extended the transferability of pre-trained Vision-Language Models (VLMs) like CLIP for various downstream tasks. These methods adopt han…
cs.CV2025
Dynamic Rank Adaptation for Vision-Language Models
Jiahui Wang, Qin Xu, Bo Jiang +1
Pre-trained large vision-language models (VLMs) like CLIP demonstrate impressive generalization ability. Existing prompt-based and adapter-based works have made significant progres…