1 paper
Shihang Zhang, Mingjin Kuai, Ye Wei +2
Video Moment Retrieval (VMR) task requires accurately localizing temporal boundaries aligned with natural language queries, but many models suffer from a misalignment between conti…