1 paper · 1 filter
Jian Ma, Xinchen Lyu, Jun Jiang +4
Collaborative large language model (LLM) inference enables real-time, privacy-preserving AI services on resource-constrained edge devices by partitioning computational workloads be…