1 paper
Bo Xue, Ji Cheng, Haodong Jing +2
This paper studies generalized low-rank matrix bandits with multiple prioritized objectives. At each round, the learner selects a matrix-valued arm and observes a vector-valued rew…