1 paper · 1 filter
Zhirui Chen, P. N. Karthik, Yeow Meng Chee +1
We consider a multi-armed bandit setting with finitely many arms, in which each arm yields an M-dimensional vector reward upon selection. We assume that the reward of each dimens…