1 paper
Filip V. Georgiev, Kalle G. Timperi, BaÅak Sakçak +1
This paper bridges some of the gap between optimal planning and reinforcement learning (RL), both of which share roots in dynamic programming applied to sequential decision making…