1 paper
Jan Robine, Tobias Uelwer, Stefan Harmeling
Sample efficiency remains a fundamental issue of reinforcement learning. Model-based algorithms try to make better use of data by simulating the environment with a model. We propos…