1 paper · 1 filter
Yuli Chen, Bo Cheng, Jiale Han +3
Pruning has recently been widely adopted to reduce the parameter scale and improve the inference efficiency of Large Language Models (LLMs). Mainstream pruning techniques often rel…