1 paper · 1 filter
Eric Zhang, Leshem Choshen, Jacob Andreas
When language models (LMs) are trained to forget (or "unlearn'') a skill, how precisely does their behavior change? We study the behavior of transformer LMs in which tasks have bee…