Showing cs.SDShow all
2 papers · 1 filter
cs.SD2024
Whisper-SV: Adapting Whisper for Low-data-resource Speaker Verification
Li Zhang, Ning Jiang, Qing Wang +3
Trained on 680,000 hours of massive speech data, Whisper is a multitasking, multilingual speech foundation model demonstrating superior performance in automatic speech recognition,…
cs.SD2024
Conversational Speech Recognition by Learning Audio-textual Cross-modal Contextual Representation
Kun Wei, Bei Li, Hang Lv +3
Automatic Speech Recognition (ASR) in conversational settings presents unique challenges, including extracting relevant contextual information from previous conversational turns. D…