1 paper
Yixuan Wang, Shutong Ding, Ke Hu +3
Diffusion and flow-based generative policies provide a powerful policy class for reinforcement learning by inducing rich stochastic exploration through iterative action generation.…