1 paper · 1 filter
Naman Kothari, Arjun Gangwar, Adarsh Arigala +1
Discrete speech units obtained via k-means clustering of self supervised embeddings entangle phonetic, speaker, and language information, causing speaker mixing and cross-lingual i…