1 paper
Zuxin Ma, Yunhe Cui, Yongbin Qin
Non-uniform structured network pruning methods can effectively reduce Large Language Model (LLM) size by eliminating redundant channels or layers, offering lower performance degrad…