2 papers
cs.SD2022
SAN: a robust end-to-end ASR model architecture
Zeping Min, Qian Ge, Guanhua Huang
In this paper, we propose a novel Siamese Adversarial Network (SAN) architecture for automatic speech recognition, which aims at solving the difficulty of fuzzy audio recognition.…
cs.SD2022
10 hours data is all you need
Zeping Min, Qian Ge, Zhong Li
We propose a novel procedure to generate pseudo mandarin speech data named as CAMP (character audio mix up), which aims at generating audio from a character scale. We also raise a…