1 paper
Xinjin Li, Yulie Lu, Jinghan Cao +3
Recent advances in Visual Question Answering (VQA) have demonstrated impressive performance in natural image domains, with models like LLaVA leveraging large language models (LLMs)…