1 paper
Zi-Han Jiang, Chien-Wei Lin, Wei-Hua Li +3
Despite advances in Large Language Models (LLMs) and Multimodal LLMs (MLLMs) for visual document understanding (VDU), visual information extraction (VIE) from relation-rich documen…