1 paper
Mohammadreza Salehi, Michael Dorkenwald, Fida Mohammad Thoker +3
Video-based pretraining offers immense potential for learning strong visual representations on an unprecedented scale. Recently, masked video modeling methods have shown promising…