cs.NE2018
A Unified Framework of DNN Weight Pruning and Weight Clustering/Quantization Using ADMM
Shaokai Ye, Tianyun Zhang, Kaiqi Zhang +6
Many model compression techniques of Deep Neural Networks (DNNs) have been investigated, including weight pruning, weight clustering and quantization, etc. Weight pruning leverages…