1 paper · 1 filter
Martin Andres Bertran, Aaron Roth, Zhiwei Steven Wu
Reusing a held-out benchmark adaptively should, in principle, invite overfitting. Yet benchmark-driven machine learning (ML) has produced surprisingly little overfitting in practic…