1 paper · 1 filter
Ziyu Ma, Shutao Li, Bin Sun +3
Knowledge-based visual question answering (VQA) requires world knowledge beyond the image for accurate answer. Recently, instead of extra knowledge bases, a large language model (L…