1 paper
Maximilian Ilse, Harshita Sharma, Anton Schwaighofer +12
Foundation vision encoders such as CLIP and DINOv2, trained on web-scale data, exhibit strong transfer performance across tasks and datasets. However, medical imaging foundation mo…