1 paper · 1 filter
Nikos Athanasiou, Ilya A. Petrov, Angela Yao +8
Vision and vision-language models rely on high-level visual representations that are increasingly used across recognition, retrieval, and multimodal reasoning pipelines. However, r…