Showing cs.SDShow all
2 papers · 1 filter
cs.SD2026
RVCBench: Benchmarking the Robustness of Voice Cloning Across Modern Audio Generation Models
Ruinan Jin, Xinting Liao, Hanlin Yu +2
Modern voice cloning, also known as zero-shot text-to-speech (TTS), can synthesize speech that closely matches a target speaker from only seconds of reference audio, enabling appli…
cs.SD2025
Leveraging Multiple Speech Enhancers for Non-Intrusive Intelligibility Prediction for Hearing-Impaired Listeners
Boxuan Cao, Linkai Li, Hanlin Yu +3
Speech intelligibility evaluation for hearing-impaired (HI) listeners is essential for assessing hearing aid performance, traditionally relying on listening tests or intrusive meth…