1 paper
Zhihan Jiang, Meng Li, Shenghao Liu +6
Deploying large language models (LLMs) as personal assistants on mobile devices demands privacy, low latency, and offline availability, yet the computational cost of giant models c…