1 paper
Mukhtiar Ali, Harsh Dubey, Sugam Mishra +1
Benchmarking video-language models has largely focused on short clips and single-sentence metrics, leaving open whether current systems can generate accurate long-form, paragraph-l…