Showing eess.ASShow all
2 papers · 1 filter
eess.AS2024
Exploring compressibility of transformer based text-to-music (TTM) models
Vasileios Moschopoulos, Thanasis Kotsiopoulos, Pablo Peso Parada +7
State-of-the art Text-To-Music (TTM) generative AI models are large and require desktop or server class compute, making them infeasible for deployment on mobile phones. This paper…
eess.AS2024
Locality enhanced dynamic biasing and sampling strategies for contextual ASR
Md Asif Jalal, Pablo Peso Parada, George Pavlidis +8
Automatic Speech Recognition (ASR) still face challenges when recognizing time-variant rare-phrases. Contextual biasing (CB) modules bias ASR model towards such contextually-releva…