1 paper
Qisong Guo, Jingtang Chen, Zhilin Chen +4
While diffusion models effectively capture multimodal behavioral priors for autonomous driving, offline reinforcement learning (RL) policies remain susceptible to distribution shif…