1 paper · 1 filter
Xiaomi MiMo Team, Anqi Liu, Aoxin Ma +28
We present a full-pipeline inference optimization for the MiMo-V2.5 model family, which combines Hybrid Sliding Window Attention (Hybrid SWA), sparse Mixture-of-Experts (MoE), and…