1 paper
Chencheng Deng, Weiling Yang, Jianbin Fang +1
General Matrix Multiplication (GEMM) is a critical kernel in high-performance computing and deep learning. While modern architectures like ARM's Scalable Matrix Extension (SME) int…