1 paper
Zeinab Ebrahimi, Gustavo Batista, Mohammad Deghat
Stochastic gradient descent (SGD) and its many variants are the widespread optimization algorithms for training deep neural networks. However, SGD suffers from inevitable drawbacks…