1 paper
Kensuke Okada, Yui Furukawa, Kyosuke Bunji
Human self-report questionnaires are increasingly used in NLP to benchmark and audit large language models (LLMs), from persona consistency to safety and bias assessments. Yet thes…