1 paper · 1 filter
Hui Sun, Shiyin Lu, Huanyu Wang +5
Video large language models (Video-LLMs) have made significant progress in understanding videos. However, processing multiple frames leads to lengthy visual token sequences, presen…