1 paper · 1 filter
Zhicheng Fang, Jingjie Zheng, Chenxu Fu +1
Jailbreak techniques for large language models (LLMs) evolve faster than benchmarks, making robustness estimates stale and difficult to compare across papers due to drift in datase…