1 paper
Shengyi Huang, Anssi Kanervisto, Antonin Raffin +3
Advantage Actor-critic (A2C) and Proximal Policy Optimization (PPO) are popular deep reinforcement learning algorithms used for game AI in recent years. A common understanding is t…