1 paper
Yuxi Xia, Kilm Zaporojets, Benjamin Roth
A diverse range of large language models (LLMs), e.g., ChatGPT, and visual question answering (VQA) models, e.g., BLIP, have been developed for solving textual and visual question…