1 paper
Amir Mohammad Ezzati, Kiyan Rezaee, Bardiya Kariminia +4
Large vision--language models (LVLMs) demonstrate strong multimodal reasoning capabilities but remain prone to hallucination, where model predictions are not grounded in visual evi…