14 citations · 23 across the 4 of their papers we have counts for
5 papers
Multiple interaction learning with question-type prior knowledge for constraining answer search space in visual question answering
Tuong Do, Binh X. Nguyen, Huy Tran +3
Different approaches have been proposed to Visual Question Answering (VQA). However, few works are aware of the behaviors of varying joint modality methods over question type prior…
Deep Metric Learning Meets Deep Clustering: An Novel Unsupervised Approach for Feature Embedding
Binh X. Nguyen, Binh D. Nguyen, Gustavo Carneiro +3
Unsupervised Deep Distance Metric Learning (UDML) aims to learn sample similarities in the embedding space from an unlabeled dataset. Traditional UDML methods usually use the tripl…
Autonomous Navigation in Complex Environments with Deep Multimodal Fusion Network
Anh Nguyen, Ngoc Nguyen, Kim Tran +2
Autonomous navigation in complex environments is a crucial task in time-sensitive scenarios such as disaster response or search and rescue. However, complex environments pose signi…
Compact Trilinear Interaction for Visual Question Answering
Tuong Do, Thanh-Toan Do, Huy Tran +2
In Visual Question Answering (VQA), answers have a great correlation with question meaning and visual contents. Thus, to selectively utilize image, question and answer information,…
Overcoming Data Limitation in Medical Visual Question Answering
Binh D. Nguyen, Thanh-Toan Do, Binh X. Nguyen +3
Traditional approaches for Visual Question Answering (VQA) require large amount of labeled data for training. Unfortunately, such large scale data is usually not available for medi…