papers
Publications (6)
cs.CL2023
AudioPaLM: A Large Language Model That Can Speak and Listen
Paul K. Rubenstein, Chulayuth Asawaroengchai, Duc Dung Nguyen +27
eess.AS2018
Direction of Arrival with One Microphone, a few LEGOs, and Non-Negative Matrix Factorization
Dalia El Badawy, Ivan DokmaniÄ
eess.SP2023
Localizing Unsynchronized Sensors with Unknown Sources
Dalia El Badawy, Viktor Larsson, Marc Pollefeys +1
cs.CL2024
Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context
Gemini Team, Petko Georgiev, Ving Ian Lei +1132
cs.CL2025
Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities
Gheorghe Comanici, Eric Bieber, Mike Schaekermann +3431
cs.CL2025
Gemini: A Family of Highly Capable Multimodal Models
Gemini Team, Rohan Anil, Sebastian Borgeaud +1340