1 paper
Xiaojie Jin, Bowen Zhang, Weibo Gong +6
State-of-the-art video-text retrieval (VTR) methods typically involve fully fine-tuning a pre-trained model (e.g. CLIP) on specific datasets. However, this can result in significan…