1 paper
Xiaoyu Fan, Huizhi Xie, Wei Zou +1
Large language model (LLM)-based text-to-speech (TTS) systems achieve remarkable naturalness via autoregressive (AR) decoding, but require N sequential steps to generate N speech t…