Showing cs.CLShow all
2 papers · 1 filter
cs.CL2025
Lethe: Purifying Backdoored Large Language Models with Knowledge Dilution
Chen Chen, Yuchen Sun, Jiaxin Gao +5
Large language models (LLMs) have seen significant advancements, achieving superior performance in various Natural Language Processing (NLP) tasks. However, they remain vulnerable…
cs.CL2024
Neutralizing Backdoors through Information Conflicts for Large Language Models
Chen Chen, Yuchen Sun, Xueluan Gong +2
Large language models (LLMs) have seen significant advancements, achieving superior performance in various Natural Language Processing (NLP) tasks, from understanding to reasoning.…