1 paper · 1 filter
Kuan-Wei Lu, Ding-Yong Hong, Pangfeng Liu +1
Large language models (LLMs) have achieved remarkable performance across a wide range of tasks, but their increasing parameter sizes significantly slow down inference. Speculative…