1 paper · 1 filter
Nikolay Radev, Lennart Haas, Benjamin Arnav +1
As agentic coding systems decompose work across multiple model instances, a critical safety question is whether those instances can coordinate to achieve a hidden malicious objecti…