1 paper · 1 filter
Ishant Chintapatla, Kazuma Choji, Naaisha Agarwal +6
Recently, many benchmarks and datasets have been developed to evaluate Vision-Language Models (VLMs) using visual question answering (VQA) pairs, and models have shown significant…