1 paper
Nik Vaessen, Roeland Ordelman, David A. van Leeuwen
This paper explores the use of Dutch archival television broadcast data for self-supervised learning of speech foundation models, specifically wav2vec 2.0. We first study data qual…