1 citations · 1 across the 1 of their papers we have counts for
1 paper
Yang Liu, Pengxiang Ding, Siteng Huang +3
Fueled by the Large Language Models (LLMs) wave, Large Visual-Language Models (LVLMs) have emerged as a pivotal advancement, bridging the gap between image and text. However, video…