1 paper · 1 filter
Hui Wang, Michael Emmerich, Mike Preuss +1
The landmark achievements of AlphaGo Zero have created great research interest into self-play in reinforcement learning. In self-play, Monte Carlo Tree Search is used to train a de…