1 paper · 1 filter
Ling Hu, Yuemei Xu, Xiaoyang Gu +1
Despite the impressive performance of large language models (LLMs), they can present unintended biases and harmful behaviors driven by encoded values, emphasizing the urgent need t…