1 paper
Moxu Duan, Jingwen Fu, Yuwang Wang
Streaming VideoLLMs process frames causally while visual tokens grow continuously, making compression essential for controlling prefilling latency and memory. Existing training-fre…