1 paper
Cheng Zhang, Cengiz Öztireli, Stephan Mandt +1
The convergence speed of stochastic gradient descent (SGD) can be improved by actively selecting mini-batches. We explore sampling schemes where similar data points are less likely…