1 paper
Aditya Agrawal, Albert Magyar, Hiteshwar Eswaraiah +5
Training and serving Large Language Models (LLMs) require partitioning data across multiple accelerators, where collective operations are frequently bottlenecked by network bandwid…