2 papers
cs.DC2026
TerraceMoE: A Cost Model for Hierarchical MoE All-to-All Communication
Weicheng Xue, Bingqiang Wang, Li Yuan +2
Hierarchical two-hop dispatch can reduce slow-fabric traffic in expert-parallel Mixture-of-Experts training, but it adds a second collective and an arrival-side operator chain. We…
physics.comp-ph2026
SMC-AI: Scaling Monte Carlo Simulation to Four Trillion Atoms with AI Accelerators
Xianglin Liu, Kai Yang, Fanli Zhou +9
The rapid advancement of deep learning is reshaping the hardware design landscape toward AI tasks, posing fundamental challenges for HPC workloads such as atomistic simulation. Her…