1 paper
Yang Li, Yajiao Wang, Wenhao Hu +2
Multimodal Information Extraction (MIE) requires fusing text and visual cues from visually rich documents. While recent methods have advanced multimodal representation learning, mo…