1 paper
Na Li, Chengda Wang, Mingju Gao +1
Diffusion large language models (DLLMs) enable non-autoregressive generation by iteratively denoising corrupted token sequences with bidirectional context. Despite their ability to…