1 paper
Yeonwoo Jang, Shariqah Hossain, Ashwin Sreevatsa +1
In this work, we demonstrate that certain machine unlearning methods may fail under straightforward prompt attacks. We systematically evaluate eight unlearning techniques across th…