1 paper
Hongliang Li, Jiaxin Zhang, Wenhui Liao +3
Current Multimodal Large Language Model (MLLM) architectures face a critical tradeoff between performance and efficiency: decoder-only architectures achieve higher performance but…