1 paper
Yiheng Yang, Yujie Wang, Chi Ma +3
Dense large language models(LLMs) face critical efficiency bottlenecks as they rigidly activate all parameters regardless of input complexity. While existing sparsity methods(stati…