1 paper · 2 filters
Zhicheng Fang, Jingjie Zheng, Chenxu Fu +1
Jailbreak techniques for large language models (LLMs) evolve faster than benchmarks, making robustness estimates stale and difficult to compare across papers due to drift in datase…