1 paper · 1 filter
Yizhuo Ding, Mingkang Chen, Zhibang Feng +4
Multimodal large language models (MLLMs) often struggle to ground reasoning in perceptual evidence. We present a systematic study of perception strategies-explicit, implicit, visua…