1 paper · 1 filter
Yangzhen Wu, Zhiqing Sun, Shanda Li +2
While the scaling laws of large language models (LLMs) training have been extensively studied, optimal inference configurations of LLMs remain underexplored. We study inference sca…