1 paper
Ruipeng Zhang, Zhihao Li, Haozhang Yuan +2
Hallucination has recently garnered significant research attention in Large Vision-Language Models (LVLMs). Direct Preference Optimization (DPO) aims to learn directly from the cor…