Lukas Hinterleitner, Loris Schoenegger, Benjamin Roth
Gradient-based methods for instance-based explanation for large language models (LLMs) are hindered by the immense dimensionality of model gradients. In practice, influence estimat…