1 paper · 1 filter
Zhi Zheng, Ziqiao Meng, Hao Luan +2
External memory effectively grounds large language models (LLMs) and vision-language models (VLMs)-based question answering (QA) in relevant multimodal evidence. However, existing…