1 paper · 1 filter
Jiho Jin, Woosung Kang, Junho Myung +1
Measuring social bias in large language models (LLMs) is crucial, but existing bias evaluation methods struggle to assess bias in long-form generation. We propose a Bias Benchmark…