1 paper
Naman Malhotra, Jay Ambadkar, Abhinav Gupta +4
Large language models are commonly aligned through supervised fine-tuning, yet little is known about how their internal representations evolve during this process. We study alignme…