1 paper · 1 filter
Yogesh Kumar
Video question answering systems built on vision-language models often produce timestamped claims with high confidence even when unsupported by the cited frame. This deceptive hall…