1 paper
Yubo Wang, Chaohu Liu, Yanqiu Qu +3
Large vision-language models (LVLMs) integrate visual information into large language models, showcasing remarkable multi-modal conversational capabilities. However, the visual mod…