1 paper
Egor Maximov, Yulia Kuzkina, Azamat Kanametov +4
As large language models (LLMs) grow in size, efficient compression techniques like quantization and sparsification are critical. While quantization maintains performance with redu…