1 paper · 1 filter
Junyu Chen, Junzhuo Li, Zhen Peng +4
Quantization and fine-tuning are crucial for deploying large language models (LLMs) on resource-constrained edge devices. However, fine-tuning quantized models presents significant…