4 papers
Reducing Hallucinated Transcripts in Whisper via Hallucination Space Projection
Maryam Abbasihafshejani, Murtuza Jadliwala
Whisper is a widely used foundation model for automatic speech recognition (ASR), but its generative decoder can produce fluent hallucinated transcripts for inputs containing littl…
VocalBridge: Latent Diffusion-Bridge Purification for Defeating Perturbation-Based Voiceprint Defenses
Maryam Abbasihafshejani, AHM Nazmus Sakib, Murtuza Jadliwala
The rapid advancement of speech synthesis technologies, including text-to-speech (TTS) and voice conversion (VC), has intensified security and privacy concerns related to voice clo…
Spiking Neural Networks in Vertical Federated Learning: Performance Trade-offs
Maryam Abbasihafshejani, Anindya Maiti, Murtuza Jadliwala
Federated machine learning enables model training across multiple clients while maintaining data privacy. Vertical Federated Learning (VFL) specifically deals with instances where…
OverHear: Headphone based Multi-sensor Keystroke Inference
Raveen Wijewickrama, Maryam Abbasihafshejani, Anindya Maiti +1
Headphones, traditionally limited to audio playback, have evolved to integrate sensors like high-definition microphones and accelerometers. While these advancements enhance user ex…