15 citations · 15 across the 3 of their papers we have counts for
1 paper · 1 filter
Hyunji Nam, Omer Gottesman, Amy Zhang +3
Large language models (LLMs) built on existing reinforcement learning with human feedback (RLHF) frameworks typically optimize responses based on immediate turn-level human prefere…