1 paper
Aarushi Wagh, Saniya Srivastava
Existing benchmarks evaluating biases in large language models (LLMs) primarily rely on explicit cues, declaring protected attributes like religion, race, gender by name. However,…