1 paper · 1 filter
Divij Handa, Zehua Zhang, Amir Saeidi +4
Recent advancements in Large Language Model (LLM) safety have primarily focused on mitigating attacks crafted in natural language or common ciphers (e.g. Base64), which are likely…