3 papers
cs.AI2026
Stop Thinking, Start Looking: Efficient Post-Training for Multimodal Document Question Answering via Reasoning-Free Alignment
Harikrishnan P M, Goutham Vignesh, Ganesh Parab +4
Efficient multimodal document question answering with explicit visual grounding, locating the precise document region that supports each answer remains an open challenge. Current a…
cs.IR2026
DocAnnot -- Accelerating the Creation of Key Information Extraction Datasets with GenAI-Powered Auto-annotation
Siddartha Reddy, Harikrishnan P M, Goutham Vignesh +2
Key Information Extraction (KIE) is vital for many document applications, but creating training datasets is traditionally a time-consuming manual process. We introduce DocAnnot, a…
cs.AI2026
Search-Based Risk Feature Discovery in Document Structure Spaces under a Constrained Budget
Saisubramaniam Gopalakrishnan, Harikrishnan P M, Dagnachew Birru
Enterprise-grade Intelligent Document Processing (IDP) systems support high-stakes workflows across finance, insurance, and healthcare. Early-phase system validation under limited…