1 paper · 1 filter
Furui Cheng, Vilém Zouhar, Robin Shing Moon Chan +3
Understanding the behavior of large language models (LLMs) is crucial for ensuring their safe and reliable use. However, existing explainable AI (XAI) methods for LLMs primarily re…