1 paper · 1 filter
Yiwei Sun, Zhihang Liu, Chuanbin Liu +3
Recently, multimodal large language models have made significant advancements in video understanding tasks. However, their ability to understand unprocessed long videos is very lim…