2 papers
cs.CR2026
Model-Agnostic Lifelong LLM Safety via Externalized Attack-Defense Co-Evolution
Xiaozhe Zhang, Chaozhuo Li, Hui Liu +4
Large language models remain vulnerable to adversarial prompts that elicit harmful outputs. Existing safety paradigms typically couple red-teaming and post-training in a closed, po…
cs.LG2026
PropGuard: Safeguarding LLM-MAS via Propagation-Aware Exploration and Remediation
Bingyu Yan, Xiaoming Zhang, Jinyu Hou +4
LLM-based multi-agent systems (LLM-MAS) have become a promising paradigm for solving complex tasks through role specialization, tool use, memory, and collaborative reasoning. Howev…