1 paper · 1 filter
Dingchen Yang, Bowen Cao, Guang Chen +1
Multi-modal Large Language Models (MLLMs) demonstrate remarkable success across various vision-language tasks. However, they suffer from visual hallucination, where the generated r…