1 paper
Kaijing Ma, Haojian Huang, Jin Chen +8
Existing Video Temporal Grounding (VTG) models excel in accuracy but often overlook open-world challenges posed by open-vocabulary queries and untrimmed videos. This leads to unrel…