1 paper
Cheng-Tao Chung, Cheng-Yu Tsai, Chia-Hsiang Liu +1
In this paper we aim to automatically discover high quality frame-level speech features and acoustic tokens directly from unlabeled speech data. A Multi-granular Acoustic Tokenizer…