1 paper · 1 filter
Yuran Ding, Xinwei Chen, Xiaofan Zhang +1
Optimizing large-language model (LLM) training on distributed domain-specific accelerator systems presents significant challenges due to its complex optimization space. Existing op…