3 papers
cs.SD2026
EnvTriCascade: An Environment-Aware Tri-Stage Cascaded Framework for ESDD2 2026 Challenge
Hengyan Huang, Xiaoxuan Guo, Jiayi Zhou +5
ADD in real-world scenarios has evolved from speech-only spoofing to more challenging component-level settings, where speech and environmental sounds may be independently manipulat…
cs.SD2026
Towards Explicit Acoustic Evidence Perception in Audio LLMs for Speech Deepfake Detection
Xiaoxuan Guo, Yuankun Xie, Haonan Cheng +5
Speech deepfake detection (SDD) focuses on identifying whether a given speech signal is genuine or has been synthetically generated. Existing audio large language model (LLM)-based…
cs.SD2025
EnvSSLAM-FFN: Lightweight Layer-Fused System for ESDD 2026 Challenge
Xiaoxuan Guo, Hengyan Huang, Jiayi Zhou +5
Recent advances in generative audio models have enabled high-fidelity environmental sound synthesis, raising serious concerns for audio security. The ESDD 2026 Challenge therefore…