1 paper
Rui Yang, Shuang Huang, Junhua Liu +7
Safety benchmarks for large language models often assess the risk of a user query, although the outcome of question answering depends on whether the response violates a policy. Thi…