1 paper
Jieyuan Liu, Jianyang Gu, Shijie Chen +2
Knowledge-based visual question answering (KB-VQA) lets vision-language systems answer questions that exceed their parametric knowledge by conditioning a reader on passages retriev…