1 paper
Juntong Wang, Shengkun Yang, Xiyuan Wang +1
Post-training can substantially alter language-model behavior, yet aggregate behavior rates do not reveal whether training removes an existing mechanism, creates a new one, or chan…