1 paper
Haidong Kang, Lihong Lin, Enneng Yang +2
Large language models (LLMs) have achieved remarkable performance on a wide range of tasks, hindering real-world deployment due to their massive size. Existing pruning methods (e.g…