1 paper
Rui Zheng, Wei Shen, Yuan Hua +9
The success of AI assistants based on language models (LLMs) hinges crucially on Reinforcement Learning from Human Feedback (RLHF), which enables the generation of responses more a…