1 paper
Zhanna Mukhametsharip, Vera Demberg, Varsha Suresh
Large Vision-Language Models (LVLMs) have demonstrated strong performance on multimodal benchmarks, yet it remains unclear whether they genuinely reason about relationships between…