1 paper
Hanwen Liu, Saierdaer Yusuyin, Hao Huang +1
Large-language-model (LLM)-based text-to-speech (TTS) systems can generate natural speech, but most are not designed for low-latency dual-streaming synthesis. High-quality dual-str…