1 citations · 2 across the 8 of their papers we have counts for
1 paper · 1 filter
Swaroop Nath, Tejpalsingh Siledar, Sankara Sri Raghava Ravindra Muddu +8
Reinforcement Learning from Human Feedback (RLHF) has become a dominating strategy in aligning Language Models (LMs) with human values/goals. The key to the strategy is learning a…