1 paper
Yuanhe Zhang, Xinyue Wang, Zhican Chen +8
Given limited and costly computational infrastructure, resource efficiency is a key requirement for large language models (LLMs). Efficient LLMs increase service capacity for provi…