13 citations · 13 across the 1 of their papers we have counts for
1 paper · 1 filter
Ziyang Wang, Yi-Lin Sung, Feng Cheng +2
The canonical approach to video-text retrieval leverages a coarse-grained or fine-grained alignment between visual and textual information. However, retrieving the correct video ac…