1 paper
Ruochen Jin, Zhanliang Wang, Zongyu Dai +2
Preference alignment often makes large language models (LLMs) overconfident and poorly calibrated. Traditional post-hoc temperature scaling is inherently domain-dependent: a temper…