1 paper
Hanyang Li, Jianhao Ma, Ying Cui
Post-training quantization (PTQ) converts a trained full-precision model into low-bit weights without task-level retraining, while quantization-aware training (QAT) incorporates qu…