3 citations · 3 across the 3 of their papers we have counts for
1 paper · 1 filter
Guan Wang, Sijie Cheng, Xianyuan Zhan +3
Nowadays, open-source large language models like LLaMA have emerged. Recent developments have incorporated supervised fine-tuning (SFT) and reinforcement learning fine-tuning (RLFT…