2 papers
cs.SD2026
Noise-to-Notes: Diffusion-based Generation and Refinement for Automatic Drum Transcription
Michael Yeung, Keisuke Toyama, Toya Teramoto +2
Automatic drum transcription (ADT) is traditionally formulated as a discriminative task to predict drum events from audio spectrograms. In this work, we redefine ADT as a condition…
cs.CV2025
VariFace: Fair and Diverse Synthetic Dataset Generation for Face Recognition
Michael Yeung, Toya Teramoto, Songtao Wu +3
The use of large-scale, web-scraped datasets to train face recognition models has raised significant privacy and bias concerns. Synthetic methods mitigate these concerns and provid…