2 papers
cs.CR2026
NeuroTrace: Inference Provenance-Based Detection of Adversarial Examples
Firas Ben Hmida, Philemon Hailemariam, Kashif Ali Khan +1
Deep neural networks (DNNs) remain largely opaque at inference time, limiting our ability to detect and diagnose malicious input manipulations such as adversarial examples. Existin…
cs.CR2026
DeepLeak: Privacy Enhancing Hardening of Model Explanations Against Membership Leakage
Firas Ben Hmida, Zain Sbeih, Philemon Hailemariam +1
Machine learning (ML) explainability is central to algorithmic transparency in high-stakes settings such as predictive diagnostics and loan approval. However, these same domains re…