1 paper · 1 filter
Yining Wang, Mi Zhang, Junjie Sun +6
Fusing visual understanding into language generation, Multi-modal Large Language Models (MLLMs) are revolutionizing visual-language applications. Yet, these models are often plague…