1 paper · 1 filter
George Karfakis, Faraz Tahmasebi, Binglu Chen +5
RAPID-LLM is a unified performance modeling framework for distributed large language model (LLM) training and inference on GPU clusters, without relying on deployment-specific trac…