1 paper
Bo Yan, Weikai Lin, Yada Zhu +1
Multi-turn jailbreak attacks progressively erode LLM safety alignment across seemingly innocuous conversation turns, achieving success rates exceeding 90% against state-of-the-art…