1 paper
Mingyang Sun, Pengxiang Ding, Weinan Zhang +1
While behavior cloning with flow/diffusion policies excels at learning complex skills from demonstrations, it remains vulnerable to distributional shift, and standard RL methods st…