2 papers
eess.AS2026
MAGE: A Coarse-to-Fine Speech Enhancer with Masked Generative Model
The Hieu Pham, Tan Dat Nguyen, Phuong Thanh Tran +2
Speech enhancement remains challenging due to the trade-off between efficiency and perceptual quality. In this paper, we introduce MAGE, a Masked Audio Generative Enhancer that adv…
eess.AS2025
Wanna hear your voice? A sample is all we need!
The Hieu Pham, Phuong Thanh Tran Nguyen, Xuan Tho Nguyen +2
Research on audio clue-based target speaker extraction (TSE) has focused on modeling mixtures and reference speech, achieving strong results in English due to abundant datasets. Ho…