1 paper
Yandi Wang, Libin Zhan, Ziwei Huang +5
Extracting structured information from visual documents (Visual Information Extraction, VIE) is a cornerstone of business automation. While recent Multimodal Large Language Models…