1 paper
Farzane Aminmansour, Taher Jafferjee, Ehsan Imani +3
Dyna-style reinforcement learning (RL) agents improve sample efficiency over model-free RL agents by updating the value function with simulated experience generated by an environme…