1 paper · 1 filter
Najmul Hasan, Prashanth BusiReddyGari
We present DPBench, a benchmark for evaluating coordination in multi-agent systems built from large language models. Existing benchmarks measure task-level success under a fixed pr…