1 paper
Hongjian Lan, Yucong Liu, Florian Schäfer
Machine learning models trained with \emph{stochastic} gradient descent (SGD) can generalize better than those trained with deterministic gradient descent (GD). In this work, we st…