1 paper
Yun-Han Lan, Wen-Yi Hsiao, Hao-Chung Cheng +1
Existing text-to-music models can produce high-quality audio with great diversity. However, textual prompts alone cannot precisely control temporal musical features such as chords…