2 papers
cs.DC2026
AsyncSparse: Accelerating Sparse Matrix-Matrix Multiplication on Asynchronous GPU Architectures
Jie Liu, Huanzhi Pu, Zhiru Zhang
Sparse Matrix-Matrix Multiplication (SpMM) is a fundamental kernel across scientific computing and machine learning. While prior work accelerates SpMM using Tensor Cores, no existi…
cs.OS2026
Hybrid Adaptive Tuning for Tiered Memory Systems
Xi Wang, Jie Liu, Shuangyan Yang +3
Memory tiering provides a cost-effective solution to increase memory capacity, utilization, and even bandwidth. Memory tiering relies on system software for memory profiling, detec…