1 paper
Miguel Lopez-Duran, Elena Marrero, Julian Fierrez +8
Document Visual Question Answering (DocVQA) presents a complex multimodal challenge, requiring models to exploit visual, textual, and layout information from documents. Although Vi…