Showing eess.ASShow all
2 papers · 1 filter
eess.AS2026
Teaching the Teachers: Boosting unsupervised domain adaptation in speech recognition by ensemble update
Rehan Ahmad, Muhammad Umar Farooq, Qihang Feng +1
Speech recognition systems often struggle with data domains that have not been included in the training. To address this, unsupervised domain adaptation has been explored with ense…
eess.AS2025
SIFT-50M: A Large-Scale Multilingual Dataset for Speech Instruction Fine-Tuning
Prabhat Pandey, Rupak Vignesh Swaminathan, K V Vijay Girish +4
We introduce SIFT (Speech Instruction Fine-Tuning), a 50M-example dataset designed for instruction fine-tuning and pre-training of speech-text large language models (LLMs). SIFT-50…