1 paper
Shunki Uebayashi, Kento Masui, Kyohei Atarashi +5
Multimodal Large Language Models (MLLMs) have recently emerged as general architectures capable of reasoning over diverse modalities. Benchmarks for MLLMs should measure their abil…