1 paper · 1 filter
Bin Chen, Yuxiang Cai, Yadan Luo +3
Reducing visual token redundancy is critical for accelerating Multimodal Large Language Models (MLLMs) without degrading cross-modal reasoning performance. Existing token pruning m…