1 paper
Landi He, Xiaoyu Yang, Lijian Xu
Visual tokens dominate inference cost in vision-language models (VLMs), yet many carry redundant information. Existing pruning methods alleviate this but typically rely on attentio…