8 citations · 12 across the 15 of their papers we have counts for
Showing 2018Show all
2 papers · 1 filter
cs.LG2018
Policy Optimization via Importance Sampling
Alberto Maria Metelli, Matteo Papini, Francesco Faccio +1
Policy optimization is an effective reinforcement learning approach to solve continuous control tasks. Recent achievements have shown that alternating online and offline optimizati…
cs.LG2018
Stochastic Variance-Reduced Policy Gradient
Matteo Papini, Damiano Binaghi, Giuseppe Canonaco +2
In this paper, we propose a novel reinforcement- learning algorithm consisting in a stochastic variance-reduced version of policy gradient for solving Markov Decision Processes (MD…