1 paper
Weici Pan, Xander Barron, Jiawei Zhou +1
Activation steering controls LLM behavior at inference time by adding learned directions to hidden states, but existing methods handle one concept at a time. Pluralistic alignment,…