1 paper
Chen Fan, Mark Schmidt, Christos Thrampoulidis
Different gradient-based methods for optimizing overparameterized models can all achieve zero training error yet converge to distinctly different solutions inducing different gener…