1 paper
Yanyi Lyu, Letian Chen, Futing Sun +3
Inference in diffusion large language models (dLLMs) is computationally expensive, as full self-attention must be repeatedly executed at each step of the denoising process without…