1 paper · 1 filter
Jinyang Zhang, Yue Fang, Hongxin Ding +5
Conventional continual pretraining (CPT) for large language model (LLM) domain adaptation often suffers from catastrophic forgetting and limited domain capacity. Existing strategie…