1 paper · 1 filter
Chenchen Yuan, Zheyu Zhang, Gjergji Kasneci
Large language models often display heterogeneous moral preferences across settings. We study inference-time steering toward a desired ethical framework while preserving general co…