2 papers
cs.LG2025
MNN-LLM: A Generic Inference Engine for Fast Large Language Model Deployment on Mobile Devices
Zhaode Wang, Jingbang Yang, Xinyu Qian +4
Large language models (LLMs) have demonstrated exceptional performance across a variety of tasks. However, their substantial scale leads to significant computational resource consu…
cs.LG2024
Research on Key Technologies for Cross-Cloud Federated Training of Large Language Models
Haowei Yang, Mingxiu Sui, Shaobo Liu +3
With the rapid development of natural language processing technology, large language models have demonstrated exceptional performance in various application scenarios. However, tra…