1 paper · 1 filter
Shibing Mo, Haoyang Ruan, Kai Wu +1
Large Language Models (LLMs) have demonstrated remarkable generalization capabilities, but aligning their outputs with human preferences typically requires expensive supervised fin…