1 paper
Xinwei Long, Zhiyuan Ma, Ermo Hua +3
Retrieval-augmented generation (RAG) has emerged to address the knowledge-intensive visual question answering (VQA) task. Current methods mainly employ separate retrieval and gener…