2 papers
cs.LG2026
Visual-Redundancy-Controlled Parallel Decoding for Diffusion-Based Multimodal Large Language Models
Yulin Yuan, Hongshuo Zhao, Xiangming Meng
Diffusion-based multimodal large language models (dMLLMs) decode by iteratively predicting tokens at multiple masked positions in parallel. This turns each decoding step into a pos…
cs.LG2026
Cluster-Level Attention-Guided Parallel Decoding for Masked Diffusion Language Models
Heqiang Qi, Wei Huang, Mingyuan Bai +1
Masked diffusion language models (MDLMs) enable parallel decoding by predicting all masked positions at each denoising step, yet existing training-free samplers usually decide whic…