Publications (19)
Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities
Gheorghe Comanici, Eric Bieber, Mike Schaekermann +3431
Heteroscedastic Treed Bayesian Optimisation
John-Alexander M. Assael, Ziyu Wang, Bobak Shahriari +1
Acme: A Research Framework for Distributed Reinforcement Learning
Matthew W. Hoffman, Bobak Shahriari, John Aslanides +36
Which Learning Algorithms Can Generalize Identity-Based Rules to Novel Inputs?
Paul Tupper, Bobak Shahriari
Exploiting correlation and budget constraints in Bayesian multi-armed bandit optimization
Matthew W. Hoffman, Bobak Shahriari, Nando de Freitas
Gemma 3 Technical Report
Gemma Team, Aishwarya Kamath, Johan Ferret +209
Knowledge Transfer from Teachers to Learners in Growing-Batch Reinforcement Learning
Patrick Emedom-Nnamdi, Abram L. Friesen, Bobak Shahriari +2
Gemma 4 Technical Report
Gemma Team, Sherif El Abd, Vaibhav Aggarwal +320
Capturing Individual Human Preferences with Reward Features
André Barreto, Vincent Dumoulin, Yiran Mao +6
On Multi-objective Policy Optimization as a Tool for Reinforcement Learning: Case Studies in Offline RL and Finetuning
Abbas Abdolmaleki, Sandy H. Huang, Giulia Vezzani +11
An Entropy Search Portfolio for Bayesian Optimization
Bobak Shahriari, Ziyu Wang, Matthew W. Hoffman +2
Gemma: Open Models Based on Gemini Research and Technology
Gemma Team, Thomas Mesnard, Cassidy Hardin +105
Critic Regularized Regression
Ziyu Wang, Alexander Novikov, Konrad Zolna +8
Unbounded Bayesian Optimization via Regularization
Bobak Shahriari, Alexandre Bouchard-Côté, Nando de Freitas
Revisiting Gaussian mixture critics in off-policy reinforcement learning: a sample-based approach
Bobak Shahriari, Abbas Abdolmaleki, Arunkumar Byravan +6
Making Efficient Use of Demonstrations to Solve Hard Exploration Problems
Tom Le Paine, Caglar Gulcehre, Bobak Shahriari +11
Learning from negative feedback, or positive feedback or both
Abbas Abdolmaleki, Bilal Piot, Bobak Shahriari +9
Gemma 2: Improving Open Language Models at a Practical Size
Gemma Team, Morgane Riviere, Shreya Pathak +195
DiffusionGemma Technical Report
DiffusionGemma Team, Adrien Ali Taïga, James Assiene +41