1 paper · 1 filter
Jing Li, Zhijie Sun, Xuan He +6
The Mixtures-of-Experts (MoE) model is a widespread distributed and integrated learning method for large language models (LLM), which is favored due to its ability to sparsify and…