1 paper
Le Xiang, Chenxi Zhai, Shu Wei +5
Vision-Language Models (VLMs) have revolutionized document parsing by enabling end-to-end mapping from images to structured text, imposing a significant latency bottleneck, particu…