1 paper
Kushal Patel, Pushkal Shrivastava, Mackenzie Lees +4
Vision-language models (VLMs) are increasingly used to extract structured fields from business documents, yet most evaluations report accuracy on clean benchmarks and offer little…