most citedCompact Trilinear Interaction for Visual Question Answering

14 citations · 23 across the 4 of their papers we have counts for

collaborators

5 papers

cs.CV20201 cited

Multiple interaction learning with question-type prior knowledge for constraining answer search space in visual question answering

Tuong Do, Binh X. Nguyen, Huy Tran +3

Different approaches have been proposed to Visual Question Answering (VQA). However, few works are aware of the behaviors of varying joint modality methods over question type prior…

cs.CV20208 cited

Deep Metric Learning Meets Deep Clustering: An Novel Unsupervised Approach for Feature Embedding

Binh X. Nguyen, Binh D. Nguyen, Gustavo Carneiro +3

Unsupervised Deep Distance Metric Learning (UDML) aims to learn sample similarities in the embedding space from an unlabeled dataset. Traditional UDML methods usually use the tripl…

cs.RO2020

Autonomous Navigation in Complex Environments with Deep Multimodal Fusion Network

Anh Nguyen, Ngoc Nguyen, Kim Tran +2

Autonomous navigation in complex environments is a crucial task in time-sensitive scenarios such as disaster response or search and rescue. However, complex environments pose signi…

cs.CV201914 cited

Compact Trilinear Interaction for Visual Question Answering

Tuong Do, Thanh-Toan Do, Huy Tran +2

In Visual Question Answering (VQA), answers have a great correlation with question meaning and visual contents. Thus, to selectively utilize image, question and answer information,…

cs.CV2019

Overcoming Data Limitation in Medical Visual Question Answering

Binh D. Nguyen, Thanh-Toan Do, Binh X. Nguyen +3

Traditional approaches for Visual Question Answering (VQA) require large amount of labeled data for training. Unfortunately, such large scale data is usually not available for medi…