1 paper · 1 filter
Amir Nuriyev, Gabriel Kulp
We present a text-reconstruction attack on mixture-of-experts (MoE) language models that recovers tokens from expert selections alone. In MoE models, each token is routed to a subs…