1 paper
Jinlun Ye, Jiang Liao, Runhe Lai +4
Vision-language models (VLMs) such as CLIP exhibit strong Out-of-distribution (OOD) detection capabilities by aligning visual and textual representations. Recent CLIP-based test-ti…