1 paper · 1 filter
Giovanni Cherubin, Andrew Paverd
Preventing jailbreaking and model hijacking of Large Language Models (LLMs) is an important yet challenging task. When interacting with a chatbot, malicious users can input special…