Showing cs.ITShow all
2 papers · 1 filter
cs.IT2026
DiP-SD: Distributed Pipelined Speculative Decoding for Efficient LLM Inference at the Edge
Yaodan Xu, Sheng Zhou, Zhisheng Niu
Speculative decoding has emerged as a promising technique for large language model (LLM) inference by accelerating autoregressive decoding via draft-then-verify. This paper studies…
cs.IT2023
Adaptive Privacy-Preserving Coded Computing With Hierarchical Task Partitioning
Qicheng Zeng, Zhaojun Nan, Sheng Zhou
Distributed computing is known as an emerging and efficient technique to support various intelligent services, such as large-scale machine learning. However, privacy leakage and ra…