1 paper
Zhonghua Jiang, Kunxi Li, Yiyun Zhou +4
Vision-Language Large Models (VLLMs) face significant efficiency challenges when processing high-resolution inputs. The quadratic complexity in attention and autoregressive generat…