2 papers
cs.CR2026
Backdooring Bias in Large Language Models
Anudeep Das, Prach Chantasantitam, Gurjot Singh +3
Large language models (LLMs) are increasingly deployed in settings where inducing a bias toward a certain topic can have significant consequences, and backdoor attacks can be used…
cs.CR2026
CAPID: Context-Aware PII Detection for Question-Answering Systems
Mariia Ponomarenko, Sepideh Abedini, Masoumeh Shafieinejad +3
Detecting personally identifiable information (PII) in user queries is critical for ensuring privacy in question-answering systems. Current approaches mainly redact all PII, disreg…