1 paper · 1 filter
Zengzipeng Tang, Yuxuan Sun, Wei Chen +2
The recent growth of on-device Large Language Model (LLM) inference has driven significant interest in device-edge collaborative LLM inference. As a promising architecture, Specula…