1 paper
Michał Bortkiewicz, Jakub Łyskawa, Paweł Wawrzyński +3
Hierarchical decomposition of control is unavoidable in large dynamical systems. In reinforcement learning (RL), it is usually solved with subgoals defined at higher policy levels…