1 paper · 1 filter
David IliÄ, Kostadin Cvejoski, David StanojeviÄ +1
All prior membership inference attacks for fine-tuned language models use hand-crafted heuristics (e.g., loss thresholding, Min-K\%, reference calibration), each bounded by the des…