1 paper
Ha Dinh, Xuan Duy Ta, Khoat Than +1
Semi-structured N:M sparsity has emerged as a practical direction for accelerating large language models (LLMs). However, existing learnable-mask approaches incur substantial p…