1 paper
Jin-Seop Lee, SungJoon Lee, SeongJun Jung +2
Video Temporal Grounding (VTG) aims to localize a temporal segment in a video corresponding to a natural language query. However, existing VTG models assume that a relevant segment…