1 paper · 1 filter
Sotirios Panagiotis Chytas, Miso Choi, Hyunwoo J. Kim +1
Vision Language Models (VLMs) show impressive capabilities in integrating and reasoning with both visual and language data. But these models make mistakes. A common finding -- simi…