1 paper
Brieuc Pinon, Raphaël Jungers, Jean-Charles Delvenne
Reinforcement Learning algorithms designed for high-dimensional spaces often enforce the Bellman equation on a sampled subset of states, relying on generalization to propagate know…