1 paper · 1 filter
Nils A. Herrmann, Leander Girrbach, Kirill Bykov +1
Recent work shows that large language models (LLMs) encode behavioral traits ("personas") as linear directions in activation space, often called "persona vectors". Prior work has u…