1 paper
Cong Ming, Jingyi Chen, Bin Liu +4
Deployed LLM safety guardrails are predominantly static: trained once and frozen at release, while new jailbreak techniques and previously un-addressed harmful categories emerge wi…