1 paper
Peiyan Zhang, Jason Xin
Recent work shows that language models can transmit behavioural traits through hidden signals in generated data during training. We ask whether a different activation-mediated chan…