1 paper · 1 filter
Zuopeng Yang, Jiluan Fan, Anli Yan +5
Multimodal Large Language Models (MLLMs) bridge the gap between visual and textual data, enabling a range of advanced applications. However, complex internal interactions among vis…