1 paper
Ziyun Dai, Xiaoqiang Li, Shaohua Zhang +2
Large Vision-Language Models (LVLMs) have demonstrated remarkable capabilities in visual understanding and multimodal reasoning. However, LVLMs frequently exhibit hallucination phe…