1 paper
Min Zhang, Yuyin Wang, Zhongxiang Dai +4
Recent advances in pre-training vision-language models (VLMs), e.g., contrastive language-image pre-training (CLIP) methods, have shown great potential in learning out-of-distribut…