3 papers
cs.CR2026
Jailbreak Foundry: From Papers to Runnable Attacks for Reproducible Benchmarking
Zhicheng Fang, Jingjie Zheng, Chenxu Fu +1
Jailbreak techniques for large language models (LLMs) evolve faster than benchmarks, making robustness estimates stale and difficult to compare across papers due to drift in datase…
cs.CR2025
SATA: A Paradigm for LLM Jailbreak via Simple Assistive Task Linkage
Xiaoning Dong, Wenbo Hu, Wei Xu +1
Large language models (LLMs) have made significant advancements across various tasks, but their safety alignment remain a major concern. Exploring jailbreak prompts can expose LLMs…
cs.CR2025
SPDZCoder: Combining Expert Knowledge with LLMs for Generating Privacy-Computing Code
Xiaoning Dong, Peilin Xin, Jia Li +1
Privacy computing receives increasing attention but writing privacy computing code remains challenging for developers due to limited library functions, necessitating function imple…