1 paper · 1 filter
Ziyi Wang, Nan Jiang, Guang Lin +1
Compressing large-scale neural networks is essential for deploying models on resource-constrained devices. Most existing methods adopt weight pruning or low-bit quantization indivi…