2 papers
cs.DC2026
Understanding GPU Resource Interference One Level Deeper
Paul Elvinger, Foteini Strati, Natalie Enright Jerger +1
GPUs are vastly underutilized, even when running resource-intensive AI applications, as GPU kernels within each job have diverse resource profiles that may saturate some parts of a…
cs.AR2024
Arcus: SLO Management for Accelerators in the Cloud with Traffic Shaping
Jiechen Zhao, Ran Shu, Katie Lim +4
Cloud servers use accelerators for common tasks (e.g., encryption, compression, hashing) to improve CPU/GPU efficiency and overall performance. However, users' Service-level Object…