1 paper
Thanh Nguyen, Tri Ton, Hongbin Choe +2
Diffusion-based Q-learning has emerged as a powerful paradigm for offline reinforcement learning, but its reliance on multi-step denoising makes both training and inference computa…