2 papers
eess.AS2024
PAM: Prompting Audio-Language Models for Audio Quality Assessment
Soham Deshmukh, Dareen Alharthi, Benjamin Elizalde +5
While audio quality is a key performance metric for various audio processing tasks, including generative modeling, its objective measurement remains a challenge. Audio-Language Mod…
eess.AS2023
Bilingual Streaming ASR with Grapheme units and Auxiliary Monolingual Loss
Mohammad Soleymanpour, Mahmoud Al Ismail, Fahimeh Bahmaninezhad +2
We introduce a bilingual solution to support English as secondary locale for most primary locales in hybrid automatic speech recognition (ASR) settings. Our key developments consti…