1 paper · 1 filter
Siyuan Dai, Lunxiao Li, Kun Zhao +6
With the rapid progress of large language models (LLMs), advanced multimodal large language models (MLLMs) have demonstrated impressive zero-shot capabilities on vision-language ta…