1 paper
Daniel I Jackson, Emma L Jensen, Syed-Amad Hussain +1
Self-assessment is a key aspect of reliable intelligence, yet evaluations of large language models (LLMs) focus mainly on task accuracy. We adapted the 10-item General Self-Efficac…