35 citations · 54 across the 4 of their papers we have counts for
4 papers
OpenViVQA: Task, Dataset, and Multimodal Fusion Models for Visual Question Answering in Vietnamese
Nghia Hieu Nguyen, Duong T. D. Vo, Kiet Van Nguyen +1
In recent years, visual question answering (VQA) has attracted attention from the research community because of its highly potential applications (such as virtual assistance on int…
EVJVQA Challenge: Multilingual Visual Question Answering
Ngan Luu-Thuy Nguyen, Nghia Hieu Nguyen, Duong T. D Vo +2
Visual Question Answering (VQA) is a challenging task of natural language processing (NLP) and computer vision (CV), attracting significant attention from researchers. English is a…
UIT-HWDB: Using Transferring Method to Construct A Novel Benchmark for Evaluating Unconstrained Handwriting Image Recognition in Vietnamese
Nghia Hieu Nguyen, Duong T. D. Vo, Kiet Van Nguyen
Recognizing handwriting images is challenging due to the vast variation in writing style across many people and distinct linguistic aspects of writing languages. In Vietnamese, bes…
VieCap4H-VLSP 2021: ObjectAoA-Enhancing performance of Object Relation Transformer with Attention on Attention for Vietnamese image captioning
Nghia Hieu Nguyen, Duong T. D. Vo, Minh-Quan Ha
Image captioning is currently a challenging task that requires the ability to both understand visual information and use human language to describe this visual information in the i…