1 paper · 1 filter
Jack King, Evelina Fedorenko, Eghbal A. Hosseini
In autoregressive large language models (LLMs), temporal straightening offers an account of how the next-token prediction objective shapes representations. Models learn to progress…