6 papers
AMRM-Pure: Semantic-Preserving Adversarial Purification
Zhihao Dou, Zhiqiang Gao, Dongfei Cui +6
Adversarial purification is a defense technique that employs generative models to remove adversarial perturbations. Current methods often rely on powerful generators, typically dif…
ReShift: Aha-Moment-Driven Reasoning-Level Backdoor Attacks on Vision-Language Models
Zhihao Dou, Qinjian Zhao, Zhiqiang Gao +1
Vision--Language Models (VLMs) are increasingly deployed in safety-critical applications, yet remain vulnerable to backdoor attacks. Existing methods primarily manipulate final out…
ProtoGuard-SL: Prototype Consistency Based Backdoor Defense for Vertical Split Learning
Yuhan Shui, Ruobin Jin, Zhihao Dou +1
Vertical split learning (SL) enables collaborative model training across parties holding complementary features without sharing raw data, but recent work has shown that it is highl…
Plan Then Action:High-Level Planning Guidance Reinforcement Learning for LLM Reasoning
Zhihao Dou, Qinjian Zhao, Zhongwei Wan +10
Large language models (LLMs) demonstrate strong reasoning abilities via Chain-of-Thought (CoT), but their token-level generation encourages local decisions and lacks global plannin…
SafeBehavior: Simulating Human-Like Multistage Reasoning to Mitigate Jailbreak Attacks in Large Language Models
Qinjian Zhao, Jiaqi Wang, Zhiqiang Gao +3
Large Language Models (LLMs) have achieved impressive performance across diverse natural language processing tasks, but their growing power also amplifies potential risks such as j…
Discrete Wavelet Transform-Based Capsule Network for Hyperspectral Image Classification
Zhiqiang Gao, Jiaqi Wang, Hangchi Shen +3
Hyperspectral image (HSI) classification is a crucial technique for remote sensing to build large-scale earth monitoring systems. HSI contains much more information than traditiona…