1 paper
Chunjin Yang, Fanman Meng, Shuai Chen +2
Large-scale vision-language models (LVLMs) pretrained on massive image-text pairs have achieved remarkable success in visual representations. However, existing paradigms to transfe…