1 paper · 1 filter
Ruiyang Qin, Qingzhuo Wang, Dongrui Liu +3
Large language models (LLMs) exhibit severe multilingual safety misalignment: they possess strong safeguards in high-resource languages but remain highly vulnerable to jailbreak at…