1 paper · 1 filter
Jinhao Li, Sarah M. Erfani, Lei Feng +2
Aligning large-scale commercial models with user intent is crucial to preventing harmful outputs. Current methods rely on human supervision but become impractical as model complexi…