1 paper
Sunoh Kim, Kimin Yun, Daeho Um
Weakly supervised temporal video grounding aims to localize query-relevant segments in untrimmed videos using only video-sentence pairs, without requiring ground-truth segment anno…