1 paper · 1 filter
Yuanshuai Li, Yuping Yan, Jirui Han +3
Hallucination remains a fundamental challenge for Multimodal Large Language Models (MLLMs). While Direct Preference Optimization (DPO) is a key alignment framework, existing approa…