1 paper
Sascha Lange, Roland Hafner, Martin Riedmiller
This article revisits the 20-year-old neural fitted Q-iteration (NFQ) algorithm on its classical CartPole benchmark. NFQ was a pioneering approach towards modern Deep Reinforcement…