1 paper · 1 filter
Pengan Chen, Kaisheng Zheng, Liang Hong +10
Vision-language models (VLMs) often answer new questions about recurring visual content, where reusing the key-value (KV) cache can avoid re-encoding expensive visual prefixes. Exa…