1 paper
Jiaqi Fan, Jianhua Wu, Hongqing Chu +2
Large vision-language models (LVLMs) have demonstrated remarkable capabilities in multimodal understanding and generation tasks. However, these models occasionally generate halluci…