3 papers
eess.AS2025
BUT System for the MLC-SLM Challenge
Alexander Polok, Jiangyu Han, Dominik Klement +3
We present a two-speaker automatic speech recognition (ASR) system that combines DiCoW -- a diarization-conditioned variant of Whisper -- with DiariZen, a diarization pipeline buil…
eess.AS2024
Joint Training of Speaker Embedding Extractor, Speech and Overlap Detection for Diarization
Petr Pálka, Federico Landini, Dominik Klement +4
In spite of the popularity of end-to-end diarization systems nowadays, modular systems comprised of voice activity detection (VAD), speaker embedding extraction plus clustering, an…
eess.AS2023
Discriminative Training of VBx Diarization
Dominik Klement, Mireia Diez, Federico Landini +4
Bayesian HMM clustering of x-vector sequences (VBx) has become a widely adopted diarization baseline model in publications and challenges. It uses an HMM to model speaker turns, a…