Audio-Native Speech Recognition with a Frozen Discrete-Diffusion Language Model
Researchers proposed a method for automatic speech recognition using a discrete diffusion language model to transcribe audio in parallel rather than through traditional autoregressive decoding.