1 paper
Yuang Cai, Yuyu Yuan, Jinsheng Shi +1
The alignment of large language models (LLMs) is crucial for generating helpful and harmless content. Existing approaches leverage preference-based human feedback data to learn the…