3 papers
eess.AS2026
Residual Learning for Neural Ambisonics Encoders
Thomas Deppisch, Yang Gao, Manan Mittal +4
Emerging wearable devices such as smartglasses and extended reality headsets demand high-quality spatial audio capture from compact, head-worn microphone arrays. Ambisonics provide…
eess.AS2025
Towards Reliable Objective Evaluation Metrics for Generative Singing Voice Separation Models
Paul A. Bereuter, Benjamin Stahl, Mark D. Plumbley +1
Traditional Blind Source Separation Evaluation (BSS-Eval) metrics were originally designed to evaluate linear audio source separation models based on methods such as time-frequency…
eess.AS2025
Distillation and Pruning for Scalable Self-Supervised Representation-Based Speech Quality Assessment
Benjamin Stahl, Hannes Gamper
In this paper, we investigate distillation and pruning methods to reduce model size for non-intrusive speech quality assessment based on self-supervised representations. Our experi…