1 paper
Alkis Koudounas, Moreno La Quatra, Marco Sabato Siniscalchi +1
Speech foundation models have demonstrated exceptional capabilities in speech-related tasks. Nevertheless, these models often struggle with non-verbal audio data, such as vocalizat…