2 papers
cs.CV2025
Flatness-aware Curriculum Learning via Adversarial Difficulty
Hiroaki Aizawa, Yoshikazu Hayashi
Neural networks trained by empirical risk minimization often suffer from overfitting, especially to specific samples or domains, which leads to poor generalization. Curriculum Lear…
cs.CV2025
Patch Pruning Strategy Based on Robust Statistical Measures of Attention Weight Diversity in Vision Transformers
Yuki Igaue, Hiroaki Aizawa
Multi-head self-attention is a distinctive feature extraction mechanism of vision transformers that computes pairwise relationships among all input patches, contributing significan…