1 paper · 1 filter
Sasha Cui, Zhongren Chen
Language models (LMs) are typically post-trained for desired capabilities and behaviors via weight-based or prompt-based steering, but the former is time-consuming and expensive, a…