3 papers
eess.AS2023
Cross-lingual Knowledge Distillation via Flow-based Voice Conversion for Robust Polyglot Text-To-Speech
Dariusz Piotrowski, Renard Korzeniowski, Alessio Falai +5
In this work, we introduce a framework for cross-lingual speech synthesis, which involves an upstream Voice Conversion (VC) model and a downstream Text-To-Speech (TTS) model. The p…
cs.RO2023
Real-time LIDAR localization in natural and urban environments
Georgi Tinchev, Adrian Penate-Sanchez, Maurice Fallon
Localization is a key challenge in many robotics applications. In this work we explore LIDAR-based global localization in both urban and natural environments and develop a method s…
eess.AS2023
Modelling low-resource accents without accent-specific TTS frontend
Georgi Tinchev, Marta Czarnowska, Kamil Deja +2
This work focuses on modelling a speaker's accent that does not have a dedicated text-to-speech (TTS) frontend, including a grapheme-to-phoneme (G2P) module. Prior work on modellin…