NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (19)

cs.CL2025

Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities

Gheorghe Comanici, Eric Bieber, Mike Schaekermann +3431

cs.LG2015

Heteroscedastic Treed Bayesian Optimisation

John-Alexander M. Assael, Ziyu Wang, Bobak Shahriari +1

cs.LG2022

Acme: A Research Framework for Distributed Reinforcement Learning

Matthew W. Hoffman, Bobak Shahriari, John Aslanides +36

cs.CL2016

Which Learning Algorithms Can Generalize Identity-Based Rules to Novel Inputs?

Paul Tupper, Bobak Shahriari

stat.ML2013

Exploiting correlation and budget constraints in Bayesian multi-armed bandit optimization

Matthew W. Hoffman, Bobak Shahriari, Nando de Freitas

cs.CL2025

Gemma 3 Technical Report

Gemma Team, Aishwarya Kamath, Johan Ferret +209

cs.LG2023

Knowledge Transfer from Teachers to Learners in Growing-Batch Reinforcement Learning

Patrick Emedom-Nnamdi, Abram L. Friesen, Bobak Shahriari +2

cs.CL2026

Gemma 4 Technical Report

Gemma Team, Sherif El Abd, Vaibhav Aggarwal +320

cs.AI2026

Capturing Individual Human Preferences with Reward Features

André Barreto, Vincent Dumoulin, Yiran Mao +6

cs.LG2023

On Multi-objective Policy Optimization as a Tool for Reinforcement Learning: Case Studies in Offline RL and Finetuning

Abbas Abdolmaleki, Sandy H. Huang, Giulia Vezzani +11

stat.ML2015

An Entropy Search Portfolio for Bayesian Optimization

Bobak Shahriari, Ziyu Wang, Matthew W. Hoffman +2

cs.CL2024

Gemma: Open Models Based on Gemini Research and Technology

Gemma Team, Thomas Mesnard, Cassidy Hardin +105

cs.LG2021

Critic Regularized Regression

Ziyu Wang, Alexander Novikov, Konrad Zolna +8

stat.ML2015

Unbounded Bayesian Optimization via Regularization

Bobak Shahriari, Alexandre Bouchard-Côté, Nando de Freitas

cs.LG2022

Revisiting Gaussian mixture critics in off-policy reinforcement learning: a sample-based approach

Bobak Shahriari, Abbas Abdolmaleki, Arunkumar Byravan +6

cs.LG2019

Making Efficient Use of Demonstrations to Solve Hard Exploration Problems

Tom Le Paine, Caglar Gulcehre, Bobak Shahriari +11

cs.LG2025

Learning from negative feedback, or positive feedback or both

Abbas Abdolmaleki, Bilal Piot, Bobak Shahriari +9

cs.CL2024

Gemma 2: Improving Open Language Models at a Practical Size

Gemma Team, Morgane Riviere, Shreya Pathak +195

cs.CL2026

DiffusionGemma Technical Report

DiffusionGemma Team, Adrien Ali Taïga, James Assiene +41