1 paper
Jiacheng Wang, Ping Jian, Zhen Yang +3
Large language models (LLMs) have made rapid progress, yet adapting them to downstream scenarios still commonly relies on supervised fine-tuning (SFT). When downstream data exhibit…