1 paper
Yang Liu, Pengxiang Ding, Siteng Huang +3
Fueled by the Large Language Models (LLMs) wave, Large Visual-Language Models (LVLMs) have emerged as a pivotal advancement, bridging the gap between image and text. However, video…