1 paper · 1 filter
Çağlar Hızlı, Çağatay Yıldız, Pekka Marttinen
State-of-the-art vision pretraining methods rely on image-level self-distillation from object-centric datasets such as ImageNet, implicitly assuming each image contains a single ob…