DiffusionGemma Decoder: ASR Without Autoregression
Researchers demonstrate that a frozen discrete-diffusion language model can perform speech recognition by refining a whole transcript in parallel. This approach promises lower latency for batch transcription but faces hurdles in real-time applications.









