1 paper · 1 filter
David Ilić, Kostadin Cvejoski, David Stanojević +1
All prior membership inference attacks for fine-tuned language models use hand-crafted heuristics (e.g., loss thresholding, Min-K\%, reference calibration), each bounded by the des…