From the 1 of 2 linked papers with an AI index.
1 paper · 1 filter
Harsha Vardhan Khurdula, Abhinav Kumar Singh, Yoeven D Khemlani +1
The paper introduces an audio‑native interface for a frozen discrete‑diffusion language model (DiffusionGemma) that transcribes speech in parallel using a Whisper encoder, a projec…