1 paper
Ziyu Ma, Shutao Li, Bin Sun +3
Knowledge-based visual question answering (VQA) requires world knowledge beyond the image for accurate answer. Recently, instead of extra knowledge bases, a large language model (L…