1 paper · 1 filter
Yonggang Zhu, Liting Gao, Aidong Men +1
Contrastive Language-Audio Pretraining (CLAP) models are widely used for audio understanding and support modality-agnostic condition swapping in many zero-shot applications. Howeve…