1 paper
Apurv Shukla, Debabrota Basu
We study the preference-based pure exploration problem for bandits with vector-valued rewards. The rewards are ordered using a (given) preference cone C and our goal is…