1 paper · 1 filter
Gianluca Detommaso, Martin Bertran, Riccardo Fogliato +1
This paper proposes the use of "multicalibration" to yield interpretable and reliable confidence scores for outputs generated by large language models (LLMs). Multicalibration asks…