2 citations · 2 across the 8 of their papers we have counts for
1 paper · 2 filters
János Flesch, Arkadi Predtetchinski, William D Sudderth +1
We study infinite-horizon Markov decision processes (MDPs) where the decision maker evaluates each of her strategies by aggregating the infinite stream of expected stage-rewards. T…