1 paper · 1 filter
Yang Li, Yajiao Wang, Wenhao Hu +2
Multimodal Information Extraction (MIE) requires fusing text and visual cues from visually rich documents. While recent methods have advanced multimodal representation learning, mo…