1 paper · 1 filter
Hao Zhang, Mengsi Lyu, Chenrui He +2
Large Multimodal Models (LMMs) have achieved significant success across various tasks. These models usually encode visual inputs into dense token sequences, which are then concaten…