3 papers
cs.CV2026
Identify, Locate, Link: End-to-End Key-Value Extraction from Document Images
A. Said Gurbuz, Ahmed Nassar, Christoph Auer +8
Document processing pipelines traditionally cascade optical character recognition (OCR) engines with downstream models for structured information extraction, leading to multi-stage…
cs.CV2025
Advanced Layout Analysis Models for Docling
Nikolaos Livathinos, Christoph Auer, Ahmed Nassar +16
This technical report documents the development of novel Layout Analysis models integrated into the Docling document-conversion pipeline. We trained several state-of-the-art object…
cs.CL2023
ESG Accountability Made Easy: DocQA at Your Service
Lokesh Mishra, Cesar Berrospi, Kasper Dinkla +11
We present Deep Search DocQA. This application enables information extraction from documents via a question-answering conversational assistant. The system integrates several techno…