1 paper · 1 filter
Mariana Costa, Camila Ferreira, Alberlucia Rafael Soarez +1
Multi-modal large language models (MLLMs) have achieved remarkable empirical progress in spatial understanding through large-scale training on spatial visual question answering dat…