1 paper · 1 filter
Declan Campbell, Sunayana Rane, Tyler Giallanza +8
Recent work has documented striking heterogeneity in the performance of state-of-the-art vision language models (VLMs), including both multimodal language models and text-to-image…