1 paper · 1 filter
Harsha Vardhan Khurdula, Abhinav Kumar Singh, Yoeven D Khemlani +1
Automatic speech recognition is dominated by autoregressive decoders that emit one token at a time. We ask whether a discrete diffusion language model can transcribe speech instead…