2 papers
eess.AS2023
Audio-free Prompt Tuning for Language-Audio Models
Yiming Li, Xiangdong Wang, Hong Liu
Contrastive Language-Audio Pretraining (CLAP) is pre-trained to associate audio features with human language, making it a natural zero-shot classifier to recognize unseen sound cat…
eess.AS2023
Semi-supervised Sound Event Detection with Local and Global Consistency Regularization
Yiming Li, Xiangdong Wang, Hong Liu +3
Learning meaningful frame-wise features on a partially labeled dataset is crucial to semi-supervised sound event detection. Prior works either maintain consistency on frame-level p…