Showing cs.CVShow all
3 papers · 1 filter
cs.CV2026
Plug-and-play Class-aware Knowledge Injection for Prompt Learning with Visual-Language Model
Junhui Yin, Nan Pu, Xinyu Zhang +4
Prompt learning has become an effective and widely used technique in enhancing vision-language models (VLMs) such as CLIP for various downstream tasks, particularly in zero-shot cl…
cs.CV2025
ReMeREC: Relation-aware and Multi-entity Referring Expression Comprehension
Yizhi Hu, Zezhao Tian, Xingqun Qi +6
Referring Expression Comprehension (REC) aims to localize specified entities or regions in an image based on natural language descriptions. While existing methods handle single-ent…
cs.CV2024
In-context Prompt Learning for Test-time Vision Recognition with Frozen Vision-language Model
Junhui Yin, Xinyu Zhang, Lin Wu +1
Current pre-trained vision-language models, such as CLIP, have demonstrated remarkable zero-shot generalization capabilities across various downstream tasks. However, their perform…