1 paper
Zhenyuan Yang, Xuhui Lin, Qinyi He +10
The emergence of Large Language Models (LLMs) and multimodal foundation models (FMs) has generated heightened interest in their applications that integrate vision and language. Thi…