1 paper · 1 filter
Wei Yang, Jingjing Fu, Rui Wang +3
Vision-language retrieval-augmented generation (RAG) has become an effective approach for tackling Knowledge-Based Visual Question Answering (KB-VQA), which requires external knowl…