6 citations · 7 across the 13 of their papers we have counts for
Showing 2022Show all
2 papers · 1 filter
cs.LG2022
Collaborative Multi-agent Stochastic Linear Bandits
Ahmadreza Moradipari, Mohammad Ghavamzadeh, Mahnoosh Alizadeh
We study a collaborative multi-agent stochastic linear bandit setting, where agents that form a network communicate locally to minimize their overall regret. In this setting, e…
cs.LG2022
Multi-Environment Meta-Learning in Stochastic Linear Bandits
Ahmadreza Moradipari, Mohammad Ghavamzadeh, Taha Rajabzadeh +2
In this work we investigate meta-learning (or learning-to-learn) approaches in multi-task linear stochastic bandit problems that can originate from multiple environments. Inspired…