3 papers
cs.SD2025
Cross-Dialect Bird Species Recognition with Dialect-Calibrated Augmentation
Jiani Ding, Qiyang Sun, Alican Akman +1
Dialect variation hampers automatic recognition of bird calls collected by passive acoustic monitoring. We address the problem on DB3V, a three-region, ten-species corpus of 8-s cl…
cs.SD2024
Audio-based Kinship Verification Using Age Domain Conversion
Qiyang Sun, Alican Akman, Xin Jing +2
Audio-based kinship verification (AKV) is important in many domains, such as home security monitoring, forensic identification, and social network analysis. A key challenge in the…
cs.SD2024
Audio Explanation Synthesis with Generative Foundation Models
Alican Akman, Qiyang Sun, Björn W. Schuller
The increasing success of audio foundation models across various tasks has led to a growing need for improved interpretability to understand their intricate decision-making process…