2 papers
cs.CV2025
VDInstruct: Zero-Shot Key Information Extraction via Content-Aware Vision Tokenization
Son Nguyen, Giang Nguyen, Hung Dao +2
Key Information Extraction (KIE) underpins the understanding of visual documents (e.g., receipts and contracts) by extracting precise semantic content and accurately capturing spat…
cs.CV2023
Instance Segmentation under Occlusions via Location-aware Copy-Paste Data Augmentation
Son Nguyen, Mikel Lainsa, Hung Dao +2
Occlusion is a long-standing problem in computer vision, particularly in instance segmentation. ACM MMSports 2023 DeepSportRadar has introduced a dataset that focuses on segmenting…