Showing cs.CLShow all
2 papers · 1 filter
cs.CL2026
Template-Based Probes Are Imperfect Lenses for Counterfactual Bias Evaluation in LLMs
Farnaz Kohankhaki, D. B. Emerson, Jacob-Junqi Tian +2
Bias in large language models (LLMs) has many forms, from overt discrimination to implicit stereotypes. Counterfactual bias evaluation is a widely used approach to quantifying bias…
cs.CL2024
On The Role of Reasoning in the Identification of Subtle Stereotypes in Natural Language
Jacob-Junqi Tian, Omkar Dige, D. B. Emerson +1
Large language models (LLMs) are trained on vast, uncurated datasets that contain various forms of biases and language reinforcing harmful stereotypes that may be subsequently inhe…