1 paper · 2 filters
Wenhong Zhu, Zhiwei He, Xiaofeng Wang +2
Aligning language models (LMs) with human preferences has become a key area of research, enabling these models to meet diverse user needs better. Inspired by weak-to-strong general…