1 paper · 1 filter
Amber Xie, Chin-Yi Cheng, Forrest Huang +1
Learning from human feedback has shown success in aligning large, pretrained models with human values. Prior works have mostly focused on learning from high-level labels, such as p…