NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (24)

cs.CL2022

Dialect-robust Evaluation of Generated Text

Jiao Sun, Thibault Sellam, Elizabeth Clark +6

cs.AI2026

HARBOR: Holistic Adaptive Risk assessment model for BehaviORal healthcare

Aditya Siddhant

cs.CL2025

Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities

Gheorghe Comanici, Eric Bieber, Mike Schaekermann +3431

cs.CL2025

Gemini: A Family of Highly Capable Multimodal Models

Gemini Team, Rohan Anil, Sebastian Borgeaud +1340

cs.CL2018

Deep Bayesian Active Learning for Natural Language Processing: Results of a Large-Scale Empirical Study

Aditya Siddhant, Zachary C. Lipton

cs.CL2018

Leveraging Native Language Speech for Accent Identification using Deep Siamese Networks

Aditya Siddhant, Preethi Jyothi, Sriram Ganapathy

cs.CL2018

Unsupervised Transfer Learning for Spoken Language Understanding in Intelligent Agents

Aditya Siddhant, Anuj Goyal, Angeliki Metallinou

cs.CL2021

mT5: A massively multilingual pre-trained text-to-text transformer

Linting Xue, Noah Constant, Adam Roberts +5

cs.CL2019

Supervised Contextual Embeddings for Transfer Learning in Natural Language Processing Tasks

Mihir Kale, Aditya Siddhant, Sreyashi Nag +3

cs.CL2019

Evaluating the Cross-Lingual Effectiveness of Massively Multilingual Neural Machine Translation

Aditya Siddhant, Melvin Johnson, Henry Tsai +5

cs.CL2021

Explicit Alignment Objectives for Multilingual Bidirectional Encoders

Junjie Hu, Melvin Johnson, Orhan Firat +2

cs.CL2023

Reinforced Self-Training (ReST) for Language Modeling

Caglar Gulcehre, Tom Le Paine, Srivatsan Srinivasan +11

cs.CL2023

SEAHORSE: A Multilingual, Multifaceted Dataset for Summarization Evaluation

Elizabeth Clark, Shruti Rijhwani, Sebastian Gehrmann +7

cs.CL2021

Harnessing Multilinguality in Unsupervised Machine Translation for Rare Languages

Xavier Garcia, Aditya Siddhant, Orhan Firat +1

cs.CL2022

Building Machine Translation Systems for the Next Thousand Languages

Ankur Bapna, Isaac Caswell, Julia Kreutzer +21

cs.CL2020

XTREME: A Massively Multilingual Multi-task Benchmark for Evaluating Cross-lingual Generalization

Junjie Hu, Sebastian Ruder, Aditya Siddhant +3

cs.CL2021

nmT5 -- Is parallel data still relevant for pre-training massively multilingual language models?

Mihir Kale, Aditya Siddhant, Noah Constant +3

cs.CL2021

Distilling Large Language Models into Tiny and Effective Students using pQRNN

Prabhu Kaliamoorthi, Aditya Siddhant, Edward Li +1

cs.CL2020

Leveraging Monolingual Data with Self-Supervision for Multilingual Neural Machine Translation

Aditya Siddhant, Ankur Bapna, Yuan Cao +5

cs.HC2018

VoCoG: An Intelligent, Non-Intrusive Assistant for Voice-based Collaborative Group-Viewing

Sumit Shekhar, Aditya Siddhant, Anindya Shankar Bhandari +1

cs.CL2022

Towards the Next 1000 Languages in Multilingual Machine Translation: Exploring the Synergy Between Supervised and Self-Supervised Learning

Aditya Siddhant, Ankur Bapna, Orhan Firat +4

cs.CL2024

Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context

Gemini Team, Petko Georgiev, Ving Ian Lei +1132

cs.CL2021

XTREME-R: Towards More Challenging and Nuanced Multilingual Evaluation

Sebastian Ruder, Noah Constant, Jan Botha +8

cs.CL2022

DOCmT5: Document-Level Pretraining of Multilingual Language Models

Chia-Hsuan Lee, Aditya Siddhant, Viresh Ratnakar +1