1 paper · 1 filter
Yufei Li, Zexin Li, Yinglun Zhu +1
Modern deployment of large language models (LLMs) frequently involves both inference serving and continuous retraining to stay aligned with evolving data and user feedback. Common…