1 paper
Hao Wu, Yingqi Fan, Jinyang Dai +3
The quadratic computational cost of processing vision tokens in Multimodal Large Language Models (MLLMs) hinders their widespread adoption. While progressive vision token pruning o…