1 paper · 1 filter
Yuto Nishimura, Takumi Hirose, Masanari Ohi +2
Recently, Text-to-speech (TTS) models based on large language models (LLMs) that translate natural language text into sequences of discrete audio tokens have gained great research…