1 paper
Christopher Lang, Alexander Braun, Abhinav Valada
Video self-supervised learning through masked spatiotemporal prediction has emerged as a promising paradigm for learning feature representations from unlabeled data. However, exist…