1 paper · 1 filter
Yue Tan, Xiaoqian Hu, Hao Xue +2
Frontier vision-language models (VLMs) have made remarkable improvements in video understanding tasks. However, real-world videos typically exist as continuously evolving data stre…