1 paper
Saied Mahdian, Peter W. Glynn
The numerical computation of equilibrium reward gradients for Markov chains appears in many applications for example within the policy improvement step arising in connection with a…