1 paper · 1 filter
Chen Fan, Mark Schmidt, Christos Thrampoulidis
Different gradient-based methods for optimizing overparameterized models can all achieve zero training error yet converge to distinctly different solutions inducing different gener…