1 paper
Keqin Liu, Richard Weber, Chengzhong Zhang
We consider a class of restless bandit problems that finds a broad application area in reinforcement learning and stochastic optimization. We consider N independent discrete-time…