1 paper
Xiaoyu Huang, Lulu Wang
Mechanistic interpretability has largely focused on language models and deterministic toy tasks. Much less is known about how sequence models internally represent latent stochastic…