1 paper
Libo Zhang, Zhaoning Zhang, Wangyang Hong +2
Although speculative decoding is widely used to accelerate Vision-Language Models (VLMs) inference, it faces severe performance collapse when applied to Video Large Language Models…