1 paper
Shiyu Liu, Xinyi Wen, Zhibin Lan +2
Despite progress in Large Vision Language Models (LVLMs), object hallucination remains a critical issue in image captioning task, where models generate descriptions of non-existent…