1 paper · 1 filter
I-Hsiang Chen, Yu-Wei Liu, Tse-Yu Wu +3
Vision-based Retrieval-Augmented Generation (VisRAG) leverages vision-language models (VLMs) to jointly retrieve relevant visual documents and generate grounded answers based on mu…