1 paper · 1 filter
David Klaška, Antonín Kučera, Vojtěch Kůr +2
Long-run average optimization problems for Markov decision processes (MDPs) require constructing policies with optimal steady-state behavior, i.e., optimal limit frequency of visit…