1 paper
Zheming Yang, Qi Guo, Yunqing Hu +4
Multimodal large language models (MLLMs) enable powerful cross-modal inference but impose significant computational and latency burdens, posing severe challenges for deployment in…