1 paper · 1 filter
Aghyad Deeb, Fabien Roger
Large Language Models' knowledge of how to perform cyber-security attacks, create bioweapons, and manipulate humans poses risks of misuse. Previous work has proposed methods to unl…