1 paper
Zhendong Liu, Yuanbi Nie, Yingshui Tan +6
Benefiting from the powerful capabilities of Large Language Models (LLMs), pre-trained visual encoder models connected to LLMs form Vision Language Models (VLMs). However, recent r…