1 paper
Dingyi Dai, Yichi Zhang, Jiahao Zhang +4
Quantization is a crucial technique for deploying deep learning models on resource-constrained devices, such as embedded FPGAs. Prior efforts mostly focus on quantizing matrix mult…