1 paper · 1 filter
Youngeun Kim, Youjia Zhang, Huiling Liu +3
Large Vision-Language Models (VLMs) enable strong multimodal reasoning but incur heavy inference costs from redundant visual tokens. Token pruning alleviates this issue, yet existi…