1 paper
Yuqian Yuan, Wentong Li, Jian Liu +5
Multimodal large language models (MLLMs) have recently achieved impressive general-purpose vision-language capabilities through visual instruction tuning. However, current MLLMs pr…