4 papers · 1 filter
Fourier is Frontier: Frequency-Aware Autoencoding for High-Fidelity Music Reconstruction
Kangdi Wang, Yusheng Dai, Jin Xu
Continuous-latent audio autoencoders form the backbone of latent music generators, yet decoders at high compression rates commonly exhibit three failure modes: high-frequency loss,…
Qwen-Music Technical Report
Jin Xu, Kangdi Wang, Ruibin Yuan +24
In this report, we introduce Qwen-Music, a powerful music generation model capable of producing highly musical and high-fidelity songs with complete vocal singing. Qwen-Music suppo…
DuoTok: Source-Aware Dual-Track Music Tokenization for Vocal-Accompaniment Generation
Rui Lin, Zhiyue Wu, Jiahe Le +5
Multi-track music generation requires tokens that preserve acoustic fidelity, support sequence modeling, and maintain cross-track structure. Reconstruction-oriented codecs retain a…
Back to Ear: Perceptually Driven High Fidelity Music Reconstruction
Kangdi Wang, Zhiyue Wu, Dinghao Zhou +3
Variational Autoencoders (VAEs) are essential for large-scale audio tasks like diffusion-based generation. However, existing open-source models often neglect auditory perceptual as…