1 paper
Zixuan Liu, Juntao Cai, Xiaoxu Cai +2
Multimodal Large Language Models (MLLMs) have demonstrated remarkable capabilities in multimodal understanding and generation. However, when textual inputs conflict with visual evi…