1 paper
Stephen Zhao, Aidan Li, Rob Brekelmans +1
Reinforcement learning (RL) has become a predominant technique to align language models (LMs) with human preferences or promote outputs which are deemed to be desirable by a given…