1 paper
Zhinan Xie, Peisong Wang, Shuang Qiu +1
Speculative decoding has proven effective for accelerating inference in Large Language Models (LLMs), yet its extension to Vision-Language Models (VLMs) remains limited by the comp…