2 papers
cs.CV2026
Who Drives the Probability Game of VLMs? A Temporal Causal Drive Evaluation Framework
Shuyao Xiao, Shengling Wang, Haoyu Niu +4
Vision-language models (VLMs) are increasingly evaluated on complex image and video understanding tasks, yet conventional metrics primarily assess final-answer quality and reveal l…
cs.CV2026
DAEP: Difficulty-Aware Evidence Planning for Medical Video Corpus Temporal Answer Grounding
Tianjian He, Yujie Liu, Zhiping Huang +1
We describe DAEP, team BIGC's submission to NLPCC 2026 Shared Task 1 Track 3: Difficulty-Aware Temporal Answer Grounding in Video Corpus (DA-TAGVC). The task requires retrieving th…