1 paper · 1 filter
Xiangru Jian, Wei Pang, Zhengyuan Dong +2
Current video analytics approaches face a fundamental trade-off between flexibility and efficiency. End-to-end Vision Language Models (VLMs) often struggle with long-context proces…