1 citations · 1 across the 3 of their papers we have counts for
1 paper · 1 filter
Jialin Song, Xiaodong Liu, Weiwei Yang +4
We present MultiBreak, a scalable and diverse multi-turn jailbreak benchmark to evaluate large language model (LLM) safety. Multi-turn jailbreaks mimic natural conversational setti…