1 paper · 1 filter
Sibo Ma, Alejandro Salinas, Peter Henderson +1
We employ model pruning to examine how LLMs conceptualize racial biases, and whether a generalizable mitigation strategy for such biases appears feasible. Our analysis yields sever…