continuous-time rl 1discrete diffusion models 1masked diffusion language models 1policy gradient methods 1trajectory subsampling 1
From the 1 of 2 linked papers with an AI index.
2 papers
cs.LG2026
A Continuous-Time Reinforcement Learning Framework for Fine-Tuning Discrete Diffusion Models
Zikun Zhang, Jiayuan Sheng, David D. Yao +1
The paper introduces a continuous‑time reinforcement‑learning framework for fine‑tuning discrete diffusion models, especially masked diffusion language models, by modeling state dy…
stat.ML2026
Tweedie's Formulae and Diffusion Generative Models Beyond Gaussian
Wenpin Tang, Nizar Touzi, Zikun Zhang +1
Diffusion models have achieved remarkable success in generating samples from unknown data distributions. Most popular stochastic differential equation-based diffusion models pertur…