1 paper
Aravind Cheruvu, Shravya Kanchi, Sifat Muhammad Abdullah +4
Customizing Large Language Models (LLMs) on untrusted datasets poses severe risks of injecting toxic behaviors. In this work, we introduce Optimus, a novel defense framework design…