1 paper
Issa Sugiura, Shuhei Kurita, Yusuke Oda +1
Speech Language Models (SpeechLMs) model tokenized speech to capture both semantic and acoustic information. When neural audio codecs based on Residual Vector Quantization (RVQ) ar…