1 paper
Seungho Baek, Taegeon Park, Jongchan Park +2
Existing offline hierarchical reinforcement learning methods rely on high-level policy learning to generate subgoal sequences. However, their efficiency degrades as task horizons i…