1 paper
Ryan Sullivan, Akarsh Kumar, Shengyi Huang +2
Most reinforcement learning methods rely heavily on dense, well-normalized environment rewards. DreamerV3 recently introduced a model-based method with a number of tricks that miti…