1 paper
Chaewon Moon, Dongkuk Si, Chulhee Yun
We study the implicit bias of Sharpness-Aware Minimization (SAM) when training L-layer linear diagonal networks on linearly separable binary classification. For linear models ($L…