1 paper · 1 filter
Omer Faruk Deniz, Ruiyu Mao, Ruochen Li +2
Multimodal Large Language Models (MLLMs) incur significant computational cost from processing numerous vision tokens through all LLM layers. Prior pruning methods operate either be…