1 paper · 1 filter
Wei Wang, Shuanghe Liu, Zhu Zhuo +4
LLM multi-agent systems suffer from Correctness Collapse, where high task-level accuracy conceals severe process-level failures. This is especially hazardous in safety-critical emb…