NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (86)

cs.CR2023

Boosting Big Brother: Attacking Search Engines with Encodings

Nicholas Boucher, Luca Pajola, Ilia Shumailov +2

cs.LG2022

Augmentation Backdoors

Joseph Rance, Yiren Zhao, Ilia Shumailov +1

cs.LG2022

Architectural Backdoors in Neural Networks

Mikel Bober-Irizar, Ilia Shumailov, Yiren Zhao +2

cs.CR2026

Thought-Transfer: Indirect Targeted Poisoning Attacks on Chain-of-Thought Reasoning Models

Harsh Chaudhari, Ethan Rathbun, Hanna Foerster +5

cs.CR2026

Soft Instruction De-escalation Defense

Nils Philipp Walter, Chawin Sitawarin, Jamie Hayes +2

cs.CL2021

Bad Characters: Imperceptible NLP Attacks

Nicholas Boucher, Ilia Shumailov, Ross Anderson +1

cs.CR2026

Honeyval: A Comprehensive Evaluation Framework for LLM-powered HTTP Honeypots

Mark Vero, Fabian Kaczmarczyck, Ivan Petrov +6

cs.LG2025

Watermarking Needs Input Repetition Masking

David Khachaturov, Robert Mullins, Ilia Shumailov +1

cs.LG2024

UnUnlearning: Unlearning is not sufficient for content regulation in advanced generative AI

Ilia Shumailov, Jamie Hayes, Eleni Triantafillou +6

cs.CR2024

Architectural Neural Backdoors from First Principles

Harry Langford, Ilia Shumailov, Yiren Zhao +2

cs.CR2026

Kraken: Higher-order EM Side-Channel Attacks on DNNs in Near and Far Field

Peter Horvath, Ilia Shumailov, Lukasz Chmielewski +2

cs.LG2022

Wide Attention Is The Way Forward For Transformers?

Jason Ross Brown, Yiren Zhao, Ilia Shumailov +1

cs.LG2026

Beyond Laplace and Gaussian: Exploring the Generalized Gaussian Mechanism for Private Machine Learning

Roy Rinberg, Ilia Shumailov, Vikrant Singhal +2

cs.CR2023

Reconstructing Individual Data Points in Federated Learning Hardened with Differential Privacy and Secure Aggregation

Franziska Boenisch, Adam Dziedzic, Roei Schuster +3

cs.CR2026

ceLLMate: Sandboxing Browser AI Agents

Luoxi Meng, Henry Feng, Ilia Shumailov +1

cs.CR2025

Locking Machine Learning Models into Hardware

Eleanor Clifford, Adhithya Saravanan, Harry Langford +5

cs.CR2025

Trusted Machine Learning Models Unlock Private Inference for Problems Currently Infeasible with Cryptography

Ilia Shumailov, Daniel Ramage, Sarah Meiklejohn +4

cs.CR2026

Architectural Backdoors for Within-Batch Data Stealing and Model Inference Manipulation

Nicolas Küchler, Ivan Petrov, Conrad Grobler +1

cs.LG2022

DARTFormer: Finding The Best Type Of Attention

Jason Ross Brown, Yiren Zhao, Ilia Shumailov +1

cs.LG2021

Sponge Examples: Energy-Latency Attacks on Neural Networks

Ilia Shumailov, Yiren Zhao, Daniel Bates +3

cs.LG2022

On the Limitations of Stochastic Pre-processing Defenses

Yue Gao, Ilia Shumailov, Kassem Fawaz +1

cs.LG2021

Manipulating SGD with Data Ordering Attacks

Ilia Shumailov, Zakhar Shumaylov, Dmitry Kazhdan +4

cs.CL2024

Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context

Gemini Team, Petko Georgiev, Ving Ian Lei +1132

cs.LG2025

Hardware and Software Platform Inference

Cheng Zhang, Hanna Foerster, Robert D. Mullins +2

cs.CL2023

Revisiting Automated Prompting: Are We Actually Doing Better?

Yulin Zhou, Yiren Zhao, Ilia Shumailov +2

cs.CR2019

Hearing your touch: A new acoustic side channel on smartphones

Ilia Shumailov, Laurent Simon, Jeff Yan +1

cs.LG2024

Inexact Unlearning Needs More Careful Evaluations to Avoid a False Sense of Privacy

Jamie Hayes, Ilia Shumailov, Eleni Triantafillou +2

cs.CR2025

Lessons from Defending Gemini Against Indirect Prompt Injections

Chongyang Shi, Sharon Lin, Shuang Song +11

cs.LG2023

Revisiting Block-based Quantisation: What is Important for Sub-8-bit LLM Inference?

Cheng Zhang, Jianyi Cheng, Ilia Shumailov +2

cs.LG2021

Rapid Model Architecture Adaption for Meta-Learning

Yiren Zhao, Xitong Gao, Ilia Shumailov +2

cs.CR2025

Reasoning Introduces New Poisoning Attacks Yet Makes Them More Complicated

Hanna Foerster, Ilia Shumailov, Yiren Zhao +4

cs.LG2023

When the Curious Abandon Honesty: Federated Learning Is Not Private

Franziska Boenisch, Adam Dziedzic, Roei Schuster +3

cs.LG2021

On Attribution of Deepfakes

Baiwu Zhang, Jin Peng Zhou, Ilia Shumailov +1

cs.LG2025

The Attacker Moves Second: Stronger Adaptive Attacks Bypass Defenses Against Llm Jailbreaks and Prompt Injections

Milad Nasr, Nicholas Carlini, Chawin Sitawarin +11

cs.LG2022

Efficient Adversarial Training With Data Pruning

Maximilian Kaufmann, Yiren Zhao, Ilia Shumailov +2

cs.CR2026

Quantamination: Dynamic Quantization Leaks Your Data Across the Batch

Hanna Foerster, Ilia Shumailov, Cheng Zhang +3

cs.CR2020

BatNet: Data transmission between smartphones over ultrasound

Almos Zarandy, Ilia Shumailov, Ross Anderson

cs.AI2025

Iterative Deployment Improves Planning Skills in LLMs

Augusto B. Corrêa, Yoav Gelberg, Luckeciano C. Melo +3

cs.LG2019

Sitatapatra: Blocking the Transfer of Adversarial Samples

Ilia Shumailov, Xitong Gao, Yiren Zhao +3

cs.CR2020

Nudge Attacks on Point-Cloud DNNs

Yiren Zhao, Ilia Shumailov, Robert Mullins +1

cs.LG2025

Machine Learning Models Have a Supply Chain Problem

Sarah Meiklejohn, Hayden Blauzvern, Mihai Maruseac +3

cs.LG2023

Tubes Among Us: Analog Attack on Automatic Speaker Identification

Shimaa Ahmed, Yash Wani, Ali Shahin Shamsabadi +4

cs.LG2022

Model Architecture Adaption for Bayesian Neural Networks

Duo Wang, Yiren Zhao, Ilia Shumailov +1

cs.LG2021

Markpainting: Adversarial Machine Learning meets Inpainting

David Khachaturov, Ilia Shumailov, Yiren Zhao +2

cs.CR2020

To compress or not to compress: Understanding the Interactions between Adversarial Attacks and Neural Network Compression

Yiren Zhao, Ilia Shumailov, Robert Mullins +1

cs.AI2023

LLM Censorship: A Machine Learning Challenge or a Computer Security Problem?

David Glukhov, Ilia Shumailov, Yarin Gal +2

cs.CR2024

Buffer Overflow in Mixture of Experts

Jamie Hayes, Ilia Shumailov, Itay Yona

cs.SI2023

ExtremeBB: A Database for Large-Scale Research into Online Hate, Harassment, the Manosphere and Extremism

Anh V. Vu, Lydia Wilson, Yi Ting Chua +2

cs.CR2020

Hey Alexa what did I just type? Decoding smartphone sounds with a voice assistant

Almos Zarandy, Ilia Shumailov, Ross Anderson

cs.LG2025

Machine Unlearning Doesn't Do What You Think: Lessons for Generative AI Policy and Research

A. Feder Cooper, Christopher A. Choquette-Choo, Miranda Bogen +34

cs.LG2024

Beyond Labeling Oracles: What does it mean to steal ML models?

Avital Shafran, Ilia Shumailov, Murat A. Erdogdu +1

cs.LG2019

The Taboo Trap: Behavioural Detection of Adversarial Samples

Ilia Shumailov, Yiren Zhao, Robert Mullins +1

cs.LG2024

Fairness Feedback Loops: Training on Synthetic Data Amplifies Bias

Sierra Wyllie, Ilia Shumailov, Nicolas Papernot

cs.CR2024

Breach By A Thousand Leaks: Unsafe Information Leakage in `Safe' AI Responses

David Glukhov, Ziwen Han, Ilia Shumailov +2

cs.LG2022

Rethinking Image-Scaling Attacks: The Interplay Between Vulnerabilities in Machine Learning Systems

Yue Gao, Ilia Shumailov, Kassem Fawaz

cs.LG2024

Machine Learning needs Better Randomness Standards: Randomised Smoothing and PRNG-based attacks

Pranav Dahiya, Ilia Shumailov, Ross Anderson

cs.CR2024

Stealing User Prompts from Mixture of Experts

Itay Yona, Ilia Shumailov, Jamie Hayes +1

cs.CY2020

Snitches Get Stitches: On The Difficulty of Whistleblowing

Mansoor Ahmed-Rengers, Ross Anderson, Darija Halatova +1

cs.LG2024

Measuring memorization in RLHF for code completion

Aneesh Pappu, Billy Porter, Ilia Shumailov +1

cs.AI2026

CaMeLs Can Use Computers Too: System-level Security for Computer Use Agents

Hanna Foerster, Tom Blanchard, Kristina Nikolić +6

cs.LG2022

In Differential Privacy, There is Truth: On Vote Leakage in Ensemble Private Learning

Jiaqi Wang, Roei Schuster, Ilia Shumailov +2

cs.CR2018

Towards Automatic Discovery of Cybercrime Supply Chains

Rasika Bhalerao, Maxwell Aliapoulios, Ilia Shumailov +2

cs.LG2025

Interpreting the Repeated Token Phenomenon in Large Language Models

Itay Yona, Ilia Shumailov, Jamie Hayes +2

cs.LG2024

Gradients Look Alike: Sensitivity is Often Overestimated in DP-SGD

Anvith Thudi, Hengrui Jia, Casey Meehan +2

cs.LG2024

The Curse of Recursion: Training on Generated Data Makes Models Forget

Ilia Shumailov, Zakhar Shumaylov, Yiren Zhao +3

cs.LG2024

Beyond Slow Signs in High-fidelity Model Extraction

Hanna Foerster, Robert Mullins, Ilia Shumailov +1

cs.LG2022

On the Necessity of Auditable Algorithmic Definitions for Machine Unlearning

Anvith Thudi, Hengrui Jia, Ilia Shumailov +1

cs.CL2025

Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities

Gheorghe Comanici, Eric Bieber, Mike Schaekermann +3431

cs.LG2019

Blackbox Attacks on Reinforcement Learning Agents Using Approximated Temporal Information

Yiren Zhao, Ilia Shumailov, Han Cui +3

cs.LG2024

ImpNet: Imperceptible and blackbox-undetectable backdoors in compiled neural networks

Eleanor Clifford, Ilia Shumailov, Yiren Zhao +2

cs.CR2025

SynthID-Image: Image watermarking at internet scale

Sven Gowal, Rudy Bunel, Florian Stimberg +23

cs.LG2025

SEA: Shareable and Explainable Attribution for Query-based Black-box Attacks

Yue Gao, Ilia Shumailov, Kassem Fawaz

cs.AI2025

Extracting alignment data in open models

Federico Barbero, Xiangming Gu, Christopher A. Choquette-Choo +6

cs.LG2025

Measuring memorization in language models via probabilistic extraction

Jamie Hayes, Marika Swanberg, Harsh Chaudhari +6

cs.LG2025

Cascading Adversarial Bias from Injection to Distillation in Language Models

Harsh Chaudhari, Jamie Hayes, Matthew Jagielski +3

cs.CR2025

When Vision Fails: Text Attacks Against ViT and OCR

Nicholas Boucher, Jenny Blessing, Ilia Shumailov +2

cs.CR2026

Exploring the limits of strong membership inference attacks on large language models

Jamie Hayes, Ilia Shumailov, Christopher A. Choquette-Choo +13

cs.LG2022

Bounding Membership Inference

Anvith Thudi, Ilia Shumailov, Franziska Boenisch +1

cs.LG2020

Towards Certifiable Adversarial Sample Detection

Ilia Shumailov, Yiren Zhao, Robert Mullins +1

cs.CR2025

Defeating Prompt Injections by Design

Edoardo Debenedetti, Ilia Shumailov, Tianqi Fan +7

cs.LG2025

Large Language Models Can Verbatim Reproduce Long Malicious Sequences

Sharon Lin, Krishnamurthy, Dvijotham +4

cs.AI2024

Operationalizing Contextual Integrity in Privacy-Conscious Assistants

Sahra Ghalebikesabi, Eugene Bagdasaryan, Ren Yi +10

cs.CY2020

Tendrils of Crime: Visualizing the Diffusion of Stolen Bitcoins

Mansoor Ahmed-Rengers, Ilia Shumailov, Ross Anderson

cs.CV2023

Human-Producible Adversarial Examples

David Khachaturov, Yue Gao, Ilia Shumailov +3

cs.SE2025

Fixing 7,400 Bugs for 1$: Cheap Crash-Site Program Repair

Han Zheng, Ilia Shumailov, Tianqi Fan +2

cs.CR2026

GitInject: Real-World Prompt Injection Attacks in AI-Powered CI/CD Pipelines

Jafar Isbarov, Umid Suleymanov, Ilia Shumailov +1