17 citations · 19 across the 4 of their papers we have counts for
4 papers
Audio Difference Captioning Utilizing Similarity-Discrepancy Disentanglement
Daiki Takeuchi, Yasunori Ohishi, Daisuke Niizumi +2
We proposed Audio Difference Captioning (ADC) as a new extension task of audio captioning for describing the semantic differences between input pairs of similar but slightly differ…
First-shot anomaly sound detection for machine condition monitoring: A domain generalization baseline
Noboru Harada, Daisuke Niizumi, Yasunori Ohishi +2
This paper provides a baseline system for First-shot-compliant unsupervised anomaly detection (ASD) for machine condition monitoring. First-shot ASD does not allow systems to do ma…
ConceptBeam: Concept Driven Target Speech Extraction
Yasunori Ohishi, Marc Delcroix, Tsubasa Ochiai +6
We propose a novel framework for target speech extraction based on semantic information, called ConceptBeam. Target speech extraction means extracting the speech of a target speake…
Introducing Auxiliary Text Query-modifier to Content-based Audio Retrieval
Daiki Takeuchi, Yasunori Ohishi, Daisuke Niizumi +2
The amount of audio data available on public websites is growing rapidly, and an efficient mechanism for accessing the desired data is necessary. We propose a content-based audio r…