1 paper
Abhishek Tyagi, Arjun Iyer, Liam Young +3
Structured weight sparsity accelerates training and inference on modern GPUs, but it trails unstructured dynamic sparse training (DST) in accuracy especially at extreme sparsity. W…