Showing cs.CLShow all
2 papers · 1 filter
cs.CL2026
PulseCol: Periodically Refreshed Column-Sparse Attention for Accelerating Diffusion Language Models
Yanyi Lyu, Letian Chen, Futing Sun +3
Inference in diffusion large language models (dLLMs) is computationally expensive, as full self-attention must be repeatedly executed at each step of the denoising process without…
cs.CL2026
FlowLM: Few-Step Language Modeling via Diffusion-to-Flow Adaptation
Runzhe Zhang, Letian Chen, Wenpeng Zhang +2
We present FlowLM, a flow matching language model transformed from pre-trained diffusion language models via efficient fine-tuning. By re-aligning the curved sampling trajectories…