1 paper
Yukuan Wei, Xudong Li, Lin F. Yang
Recent advances have significantly improved our understanding of the sample complexity of learning in average-reward Markov decision processes (AMDPs) under the generative model. H…