1 paper
Kamil Książek, Piotr Suszyński, Michał Jan Włodarczyk +2
Vision foundation models, such as DINOv2, learn highly expressive representations but rely on massive, opaque architectures that demand substantial computational power and memory.…