1 paper
Jeongseok Kim, Jemin Lee, Yongin Kwon +1
Mixed-precision quantization methods have been proposed to reduce model size while minimizing accuracy degradation. However, existing studies require retraining and do not consider…