1 paper · 1 filter
Asad Bakija, Florent De Geeter, Julien Brandoit +2
In reinforcement learning (RL), agents acting in partially observable Markov decision processes (POMDPs) must rely on memory, typically encoded in a recurrent neural network (RNN),…