1 paper
Jiahui Wang, Kai Zhang, Mai Han +1
Vision-Language Models (VLMs) have demonstrated remarkable capabilities but suffer from significant computational overhead during inference. While visual token pruning offers a pro…