1 paper
Hyeon Seong Jeong, Sangwoo Jo, Byeong Hyun Yoon +3
Understanding complex multimodal documents remains challenging due to their structural inconsistencies and limited training data availability. We introduce \textit{DocsRay}, a trai…