73 citations · 92 across the 6 of their papers we have counts for
6 papers · 1 filter
Improved Normalizing Flow-Based Speech Enhancement using an All-pole Gammatone Filterbank for Conditional Input Representation
Martin Strauss, Matteo Torcoli, Bernd Edler
Deep generative models for Speech Enhancement (SE) received increasing attention in recent years. The most prominent example are Generative Adversarial Networks (GANs), while norma…
Objective Measures of Perceptual Audio Quality Reviewed: An Evaluation of Their Application Domain Dependence
Matteo Torcoli, Thorsten Kastner, Jürgen Herre
Over the past few decades, computational methods have been developed to estimate perceptual audio quality. These methods, also referred to as objective quality measures, are usuall…
Controlling the Perceived Sound Quality for Dialogue Enhancement with Deep Learning
Christian Uhle, Matteo Torcoli, Jouni Paulus
Speech enhancement attenuates interfering sounds in speech signals but may introduce artifacts that perceivably deteriorate the output signal. We propose a method for controlling t…
A Hands-on Comparison of DNNs for Dialog Separation Using Transfer Learning from Music Source Separation
Martin Strauss, Jouni Paulus, Matteo Torcoli +1
This paper describes a hands-on comparison on using state-of-the-art music source separation deep neural networks (DNNs) before and after task-specific fine-tuning for separating s…
An Improved Measure of Musical Noise Based on Spectral Kurtosis
Matteo Torcoli
Audio processing methods operating on a time-frequency representation of the signal can introduce unpleasant sounding artifacts known as musical noise. These artifacts are observed…
MPEG-H Audio for Improving Accessibility in Broadcasting and Streaming
Christian Simon, Matteo Torcoli, Jouni Paulus
Broadcasting and streaming services still suffer from various levels of accessibility barriers for a significant portion of the population, limiting the access to information and c…