1 paper
Shiguo Lian, Kaikai Zhao, Xinhui Liu +5
General large language models enhanced with supervised fine-tuning and reinforcement learning from human feedback are increasingly popular in academia and industry as they generali…