Showing cs.LGShow all
2 papers · 1 filter
cs.LG2026
Forgetting Only What Matters: Layer-Selective Unlearning toward Robust LLMs
Ravi Ranjan, Olivera Kotevska, Agoritsa Polyzou
Large Language Models (LLMs) can memorize and reproduce sensitive, copyrighted, or otherwise undesirable training content, creating privacy, safety, and regulatory concerns. Machin…
cs.LG2026
G-Drift MIA: Membership Inference via Gradient-Induced Feature Drift in LLMs
Ravi Ranjan, Utkarsh Grover, Xiaomin Lin +1
Large language models (LLMs) are trained on massive web-scale corpora, raising growing concerns about privacy and copyright. Membership inference attacks (MIAs) aim to determine wh…