1 paper
Liubov Chubarova, Alexandra Kuleshova, Daniil Volkov +2
While Multimodal Large Language Models (MLLMs) have made significant strides in visual comprehension, their ability to reason about text-dense, professional documents remains incom…