1 paper · 1 filter
Guitao Chen, Yunshen Wang, Hongye Sun +1
Generative language models (LMs) offer numerous advantages but may produce inappropriate or harmful outputs due to the harmful knowledge acquired during pre-training. This knowledg…