1 paper
Soham Deshmukh, Shuo Han, Hazim Bukhari +4
Recent literature uses language to build foundation models for audio. These Audio-Language Models (ALMs) are trained on a vast number of audio-text pairs and show remarkable perfor…