1 paper · 1 filter
Hazel Kim, Tom A. Lamb, Adel Bibi +2
Large language models (LLMs) frequently generate confident yet inaccurate responses, introducing significant risks for deployment in safety-critical domains. We present a novel, te…