1 paper · 1 filter
Xihao Chen, Yangyang Guo, Roger Zimmermann
Key-Value (KV) cache has become a de facto component of modern Large Vision-Language Models (LVLMs) for inference. While it enhances decoding efficiency in Large Language Models (L…