1 citations · 1 across the 3 of their papers we have counts for
1 paper · 1 filter
Quanxi Zhou, Wencan Mao, Manabu Tsukada +2
Model-based reinforcement learning (MBRL) and model-free reinforcement learning (MFRL) evolve along distinct paths but converge in the design of Dyna-Q [1]. However, modern RL meth…