1 paper · 1 filter
Ya-Qi Yu, Minghui Liao, Jihao Wu +3
Multimodal Large Language Models (MLLMs) have shown impressive results on various multimodal tasks. However, most existing MLLMs are not well suited for document-oriented tasks, wh…