1 paper
Jing Jin, Hao Liu, Yan Bai +9
Multimodal large language models (MLLMs) have shown promising reasoning abilities, yet evaluating their performance in specialized domains remains challenging. STEM reasoning is a…