1 paper
Nirajan Paudel, Michael Ginn, Luc De Nardi +1
Speculative decoding is a popular technique for large language model (LLM) inference, enabling faster generation by drafting multiple tokens with a smaller draft model. However, th…