1 paper · 1 filter
Shizhuo Mao, Song Chen, Yi Kang
Large language models (LLMs) excel at natural language tasks but face deployment challenges due to their growing size outpacing GPU memory advancements. Model quantization mitigate…