1 paper
Bin Chen, Yuxiang Cai, Yadan Luo +3
Reducing visual token redundancy is critical for accelerating Multimodal Large Language Models (MLLMs) without degrading cross-modal reasoning performance. Existing token pruning m…