1 paper
Yujia Tong, Tian Zhang, Yunyang Wan +3
Speculative decoding has emerged as a promising approach to accelerate inference in vision-language models (VLMs) by enabling parallel verification of multiple draft tokens. Howeve…