1 paper
Julian Skifstad, Xinyue Annie Yang, Glen Chou
Inference-time LLM alignment methods, particularly activation steering, offer an alternative to fine-tuning by directly modifying activations during generation. Existing methods, h…