1 paper · 1 filter
Liang Wang, Haoyang Li, Chao Wang +3
Prompt tuning adapts CLIP-based vision-language models with few trainable parameters, yet its predictions remain sensitive to the spatial sampling imposed by a frozen vision transf…