1 paper · 1 filter
Andrej Bogdanov, Alon Rosen, Neekon Vafa
We show how an adversarial model trainer can plant backdoors in a large class of deep, feedforward neural networks. These backdoors are statistically undetectable in the white-box…