1 paper
Jingfan Zhang, Yi Zhao, Dan Chen +3
Low-rank adaptation (LoRA) and its mixture-of-experts (MOE) variants are highly effective parameter-efficient fine-tuning (PEFT) methods. However, they introduce significant latenc…