1 paper
Siyi Liu, Hanjun Yang, Chenchen Zhang +7
Large vision-language models used as listwise rerankers must jointly process visual tokens from tens of candidates per query, making token pruning essential for practical deploymen…