1 paper · 1 filter
Jing Bi, Junjia Guo, Yunlong Tang +3
Recent advancements in Multimodal Large Language Models (MLLMs) have demonstrated remarkable progress in visual understanding. This impressive leap raises a compelling question: ho…