1 paper · 1 filter
Subrat Prasad Panda, Blaise Genest, Arvind Easwaran
(Flat) Reinforcement Learning (RL) agents face significant challenges in environments with sparse rewards that require long-horizon reasoning. A compelling approach to improve samp…