1 paper
Hrishikesh Viswanath, Tianyi Zhang
Recent studies have demonstrated that large pretrained language models (LLMs) such as BERT and GPT-2 exhibit biases in token prediction, often inherited from the data distributions…