Showing eess.ASShow all
2 papers · 1 filter
eess.AS2024
SA-WavLM: Speaker-Aware Self-Supervised Pre-training for Mixture Speech
Jingru Lin, Meng Ge, Junyi Ao +2
It was shown that pre-trained models with self-supervised learning (SSL) techniques are effective in various downstream speech tasks. However, most such models are trained on singl…
eess.AS2023
Prompt-driven Target Speech Diarization
Yidi Jiang, Zhengyang Chen, Ruijie Tao +3
We introduce a novel task named `target speech diarization', which seeks to determine `when target event occurred' within an audio signal. We devise a neural architecture called Pr…