1 paper · 1 filter
Patrick Haller, Fabio Barth, Jonas Golde +2
Vision-language models (VLMs) have demonstrated remarkable progress in multimodal reasoning. However, existing benchmarks remain limited in terms of high-quality, human-verified ex…