1 paper · 1 filter
Feixiang Liu, Qiang Qiu, Hao Zhang +1
Visual-token pruning is usually judged by answer quality at a fixed retention budget. For text-rich multimodal large language models (MLLMs), this protocol can miss a distinct fail…