1 paper
Mohammad Mohammadamini, Daban Q. Jaff, Josep Crego +2
We present KUTED, a speech-to-text translation (S2TT) dataset for Central Kurdish, derived from TED and TEDx talks. The corpus comprises 91,000 sentence pairs, including 170 hours…