1 paper · 1 filter
Zhanna Mukhametsharip, Vera Demberg, Varsha Suresh
Large Vision-Language Models (LVLMs) have demonstrated strong performance on multimodal benchmarks, yet it remains unclear whether they genuinely reason about relationships between…