1 paper · 1 filter
Tianyao Shi, Yi Ding
Large language models (LLMs) have demonstrated remarkable capabilities across diverse domains, but their heavy resource demands make quantization-reducing precision to lower-bit fo…