1 paper · 1 filter
Ethan C. Jackson, Mark Daley
Reinforcement learning (RL) problems often feature deceptive local optima, and learning methods that optimize purely for reward signal often fail to learn strategies for overcoming…