2 papers
cs.CV2026
Vision Transformer-Conditioned UNet for Domain-Adaptive Semantic Segmentation
Joel Valdivia Ortega, Tingying Peng, Marion Jasnin
Semantic segmentation is essential for analysing anatomical features in biomedical research, yet a performance gap remains for Vision Transformers (ViTs) in the field, particularly…
cs.CV2025
Randomized-MLP Regularization Improves Domain Adaptation and Interpretability in DINOv2
Joel Valdivia Ortega, Lorenz Lamm, Franziska Eckardt +3
Vision Transformers (ViTs), such as DINOv2, achieve strong performance across domains but often repurpose low-informative patch tokens in ways that reduce the interpretability of a…