1 paper
Kaihsun Yang, Min-Yan Tsai, Chia-Mu Yu
Model quantization is widely adopted to reduce memory usage and inference cost when deploying deep neural networks on resource-constrained devices. However, recent studies have rev…