1 paper
Yu Han, Lehan Pan, Jie Peng +4
Sparse Mixture of Experts (SMoE) enables scalable parameter growth in large language models (LLMs) by selectively activating a subset of experts, and its large parameter count nece…