1 paper
Ali Najar, Alireza Mirrokni, Arshia Izadyari +5
Vision-Language Models (VLMs) have achieved strong performance on standard vision-language benchmarks, yet often rely on surface-level recognition rather than deeper reasoning. We…