1 paper
Jonathan Katzy, Razvan-Mihai Popescu, Erik Mekkes +2
Large language models have found success by scaling up capabilities to work in general settings. The same can unfortunately not be said for interpretability methods. The current tr…