1 paper · 1 filter
Longtian Qiu, Shan Ning, Chuyu Zhang +2
Direct Preference Optimization (DPO) has shown strong potential for mitigating hallucinations in Multimodal Large Language Models (MLLMs). However, existing multimodal DPO approach…