1 paper
Yung-Chin Chen, Chung Peng Lee, Ze-Wei Liou +1
Massive activation spikes in Large Language Models (LLMs) severely degrade quantization by stretching dynamic ranges. While prior hypotheses characterize these as high-level scalar…