1 paper · 1 filter
Jonathan von Rad, Yong Cao, Andreas Geiger
Model compression is increasingly essential for deploying large language models (LLMs), yet existing comparative studies largely focus on pruning and quantization evaluated primari…