1 paper
Hubert Plisiecki, Filip Chmielewski, Kacper Dudzic +3
Language models are increasingly asked to self-report, informing safety evaluations, public understanding, and model-welfare debates. Yet their reports are elicited with human ques…