1 paper
Maël Jenny, Jérémie Dentan, Sonia Vanier +1
Most jailbreak techniques for Large Language Models (LLMs) primarily rely on prompt modifications, including paraphrasing, obfuscation, or conversational strategies. Meanwhile, abl…