1 paper · 1 filter
Sicheng Feng, Kaiwen Tuo, Song Wang +3
Fine-grained visual reasoning remains a core challenge for multimodal large language models (MLLMs). The recently introduced ReasonMap highlights this gap by showing that even adva…