1 paper · 1 filter
Junhui He, Shangyu Wu, Weidong Wen +2
Deploying large language models (LLMs) on edge devices presents significant challenges due to the substantial computational overhead and memory requirements. Activation sparsificat…