10 papers
Who Bridges Safety? Identifying and Targeting Cross-Lingual Shared Safety Pathways
Shuyi Miao, Wangjie Qiu, Pengyang Shao +4
Uncovering the internal mechanisms underlying the safety capabilities of large language models (LLMs) is crucial for developing trustworthy artificial intelligence. Currently, mech…
E-MIA: Exam-Style Black-Box Membership Inference Attacks against RAG Systems
Zelin Guan, Shengda Zhuo, Zeyan Li +4
Retrieval-Augmented Generation (RAG) equips large language models (LLMs) with external evidence by retrieving documents at inference time, but it also turns the retrieval corpusint…
Taming Noise-Induced Prototype Degradation for Privacy-Preserving Personalized Federated Fine-Tuning
Yuhua Wang, Qinnan Zhang, Xiaodong Li +6
Prototype-based Personalized Federated Learning (ProtoPFL) enables efficient multi-domain adaptation by communicating compact class prototypes, but directly sharing them poses priv…
UniDetect: LLM-Driven Universal Fraud Detection across Heterogeneous Blockchains
Shuyi Miao, Wangjie Qiu, Shengda Zhuo +5
As cross-chain interoperability advances, decentralized finance (DeFi) protocols enable illicit funds to be reorganized into uniform liquid assets that flow throughout the cryptocu…
Mask-Free Privacy Extraction and Rewriting: A Domain-Aware Approach via Prototype Learning
Xiaodong Li, Yuhua Wang, Qingchen Yu +5
Client-side privacy rewriting is crucial for deploying LLMs in privacy-sensitive domains. However, existing approaches struggle to balance privacy and utility. Full-text methods of…
Mosaic: Multimodal Jailbreak against Closed-Source VLMs via Multi-View Ensemble Optimization
Yuqin Lan, Gen Li, Yuanze Hu +6
Vision-Language Models (VLMs) are powerful but remain vulnerable to multimodal jailbreak attacks. Existing attacks mainly rely on either explicit visual prompt attacks or gradient-…