1 paper · 1 filter
Abhigya Verma, Khyati Mahajan, Amit Kumar Saha +4
Vision language models (VLMs) have achieved strong performance on visual document understanding benchmarks such as DocVQA, ChartQA, and MMLongBench-Doc. However, real-world documen…