1 paper
Wenkai Li, Fan Yang, Shaunak A. Mehta +1
Personality imbuing customizes LLM behavior, but safety evaluations almost always study prompt-based personas alone. We show this is incomplete: prompting and activation steering e…