1 paper · 1 filter
Yifan Jiang, Jiarui Zhang, Kexuan Sun +5
While multi-modal large language models (MLLMs) have shown significant progress on many popular visual reasoning benchmarks, whether they possess abstract visual reasoning abilitie…