1 paper
Shan Wang, Maying Shen, Nadine Chang +3
Multimodal large language models achieve strong performance across diverse tasks but remain prone to hallucinations, where outputs are not grounded in visual inputs. This issue can…