1 paper
Junhui He, Shangyu Wu, Weidong Wen +2
Deploying large language models (LLMs) on edge devices presents significant challenges due to the substantial computational overhead and memory requirements. Activation sparsificat…