1 paper
Ishant Chintapatla, Kazuma Choji, Naaisha Agarwal +6
Recently, many benchmarks and datasets have been developed to evaluate Vision-Language Models (VLMs) using visual question answering (VQA) pairs, and models have shown significant…