1 paper
Wenyuan Liu, Xindian Ma, Peng Zhang +1
Post-Training Quantization (PTQ) is an effective technique for compressing Large Language Models (LLMs). While many studies focus on quantizing both weights and activations, it is…