A Notation for Markov Decision Processes
arXiv:1512.09075
Abstract
This paper specifies a notation for Markov decision processes.
Cited by in corpus (4)
- Data-Efficient Off-Policy Policy Evaluation for Reinforcement Learning
- Policy Gradient Methods for Reinforcement Learning with Function Approximation and Action-Dependent Baselines
- Active Reinforcement Learning: Observing Rewards at a Cost
- Data-Efficient Policy Evaluation Through Behavior Policy Search