15 citations
1 paper · 1 filter
Pablo Hernandez-Leal, Bilal Kartal, Matthew E. Taylor
In this paper we explore how actor-critic methods in deep reinforcement learning, in particular Asynchronous Advantage Actor-Critic (A3C), can be extended with agent modeling. Insp…