1 paper · 1 filter
Andrew Hundt, Benjamin Killeen, Nicholas Greene +4
Current Reinforcement Learning (RL) algorithms struggle with long-horizon tasks where time can be wasted exploring dead ends and task progress may be easily reversed. We develop th…