2 papers
cs.AI2020
Cross-modal Knowledge Reasoning for Knowledge-based Visual Question Answering
Jing Yu, Zihao Zhu, Yujing Wang +3
Knowledge-based Visual Question Answering (KVQA) requires external knowledge beyond the visible content to answer questions about an image. This ability is challenging but indispen…
cs.IR2018
Modeling Text with Graph Convolutional Network for Cross-Modal Information Retrieval
Jing Yu, Yuhang Lu, Zengchang Qin +4
Cross-modal information retrieval aims to find heterogeneous data of various modalities from a given query of one modality. The main challenge is to map different modalities into a…