1 paper
Guanyuan Pan, Shuai Wang, Yugui Lin +4
Vision Language Models (VLMs) have demonstrated remarkable potential in multimodal reasoning. However, they can have spatial blindness and logical hallucinations when interpreting…