1 paper
Shuwen Yu, Zhanxuan Hu, Yi Zhao +2
Foundation models have driven rapid progress in computer vision, yet the two dominant paradigms, vision-language foundation models (VLMs) and vision-only foundation models (VFMs),…