1 paper
Mayank Kumar Singh, Naoya Takahashi, Onoe Naoyuki
Many existing works on voice conversion (VC) tasks use automatic speech recognition (ASR) models for ensuring linguistic consistency between source and converted samples. However,…