1 paper · 1 filter
Jodi M. Casabianca, Maggie Beiting-Parrish
Human evaluations play a central role in training and assessing AI models, yet these data are rarely treated as measurements subject to systematic error. This paper integrates psyc…