1 paper
Thomas Woergaard, Raghavendra Selvan
Compressing neural networks by quantizing model parameters offers useful trade-off between performance and efficiency. Methods like quantization-aware training and post-training qu…