1 paper
Selim Kuzucu, Alessio Tonioni, Vasile Lup +3
Large Vision-Language Models (LVLMs) map visual inputs into dense token sequences, imposing a quadratic computational bottleneck for inference. Elastic visual-token compression add…