1 paper · 1 filter
Tong Zhang, Jiangning Zhang, Zhucun Xue +9
Balancing convergence speed, generalization capability, and computational efficiency remains a core challenge in deep learning optimization. First-order gradient descent methods, e…