1 paper
Chirag Parmar, Akshat Mehta, Henglin Wu +2
When does multi-agent debate help data cleaning, and when does it hurt? Across three benchmarks, four model families, and over 6,000 task-condition pairs, we find debate's effect r…