1 paper
Jordan Dotzel, Gang Wu, Andrew Li +9
Quantization has become a mainstream compression technique for reducing model size, computational requirements, and energy consumption for modern deep neural networks (DNNs). With…